feat: Größe ist das letzte alleinstehende (L)-Token der Zeile (D68)
Erkannt nur alleinstehend angesetzt (wie #id und :#…) — damit greifen die Zitier-Konventionen "(L)" und ((L)) von selbst, und Backend(L) bleibt Label. Das letzte Token gewinnt statt des ersten: Die Größe steht hinter dem Titel, frühere Vorkommen sind Text. SPEC §1/§5 und llms.md nachgezogen; mitgelieferte Beispiele unverändert (Parse-Vergleich alt/neu). Co-Authored-By: Claude Fable 5 <noreply@anthropic.com>
This commit is contained in:
co-authored by
Claude Fable 5
parent
9999c7973e
commit
59da485af6
@@ -19,6 +19,7 @@ reverse.
|
||||
|
||||
## 2026-08-25
|
||||
|
||||
- The size is now the last free-standing `(L)`-style token of the line — earlier ones stay in the title, and `"(L)"` or `((L))` mention a size literally
|
||||
- Fix: Ctrl+click on a dependency preceded by a non-breaking space did nothing, although the parser reads it as a dependency
|
||||
- Ctrl+click a dependency `:#id` in the text jumps to the line that defines the ID — Ctrl+Enter does the same at the caret
|
||||
|
||||
|
||||
@@ -5056,3 +5056,45 @@ kann den Handler prinzipiell nicht treffen — der erste Prüflauf sah deshalb
|
||||
wie ein Fehler aus, der keiner war. Geprüft wird das Tastatur-Pendant mit
|
||||
einem korrekt gebauten `KeyboardEvent`; der Klick-Weg ließ sich dagegen echt
|
||||
auslösen.
|
||||
|
||||
## D68 — Größe: das letzte alleinstehende Token, nicht das erste
|
||||
Gemeldet vom Nutzer: Manchmal braucht der Titel runde Klammern — und wenn ihr
|
||||
Inhalt zufällig ein Größenkürzel ist (`Variante (L) bauen`), fraß die
|
||||
Extraktion das Titel-`(L)` als Größe. Mit echter Angabe dahinter war es
|
||||
doppelt falsch: Das Literal wurde die Größe, das gemeinte `(M)` blieb im
|
||||
Label. Entschieden (Nutzer): beide vorgeschlagenen Regeln kombiniert.
|
||||
|
||||
**Alleinstehend angesetzt** (`(^|\s)\(…\)`) — dieselbe Regel-Familie wie bei
|
||||
`#id`, `:#…`, `!!!` und `&tag`, und der eigentliche Gewinn liegt darin, dass
|
||||
die **vorhandenen Zitier-Konventionen dadurch von selbst greifen**: `"(L)"`
|
||||
bleibt Label (das `(` hängt am `"`), `((L))` ebenso (am äußeren `(`). Kein
|
||||
neues Zeichen, kein Escape — die Notation escapt weiterhin nirgends (D59).
|
||||
Wer eine Größe erwähnen will, zitiert sie; llms.md führt beide Formen in der
|
||||
Zitier-Faustregel.
|
||||
|
||||
**Das letzte Token gewinnt, nicht das erste.** Die übliche Schreibweise
|
||||
stellt die Größe hinter den Titel — das letzte Token ist die Angabe, alles
|
||||
davor ist Text. Damit löst sich auch der Fall ohne Anführungszeichen richtig
|
||||
auf: `Variante (L) bauen (M)` → Größe `M`, Label „Variante (L) bauen“. In
|
||||
der Idee-Runde war „letztes statt erstes“ zunächst verworfen worden („stille
|
||||
Umdeutung bestehender Zeilen“); der Einwand wiegt hier wenig, weil die alte
|
||||
Erste-gewinnt-Lesart in genau diesen Zeilen schon falsch war — es gibt keine
|
||||
richtige Bedeutung, die verloren ginge.
|
||||
|
||||
**Preis, benannt:** `Backend(L)` ohne Leerzeichen ist keine Größe mehr. Der
|
||||
Fehlermodus ist der laute (das Badge fehlt sichtbar, D59-Haltung), und in den
|
||||
mitgelieferten Beispielen kommt die enge Schreibweise nicht vor — geprüft per
|
||||
Grep und per Parse-Vergleich alt/neu über alle `docs/examples/*.werkbaum`
|
||||
(Knoten- und Größenzahlen identisch, Warnungen unverändert; die drei
|
||||
`sizeConflict` der Demo-Pläne sind Altbestand).
|
||||
|
||||
**Umgesetzt als Schleife über alle Treffer** statt eines cleveren
|
||||
Rückwärts-Regex: gut lesbar, und der führende Leerraum der Fundstelle bleibt
|
||||
beim Entfernen stehen (wie `pre` bei den übrigen Extraktionen). SPEC §1
|
||||
(Schritt 4, eigener Größen-Block, Referenz-Regex) und §5 zuerst, llms.md im
|
||||
selben Zug (Schritt-3-Regel, Größen-Abschnitt, Zitier-Faustregel).
|
||||
|
||||
**Nachgemessen:** 445 Tests (4 neue in `tests/parser.test.js`); Gegenprobe
|
||||
per Mutation: erster statt letzter Treffer → genau der Letztes-gewinnt-Test
|
||||
fällt; Anker entfernt → genau die zwei Alleinstehend-/Zitier-Tests. Alle
|
||||
Snapshots (kanonisches Beispiel §10) unverändert.
|
||||
|
||||
+25
-1
@@ -20,7 +20,9 @@ dieser Reihenfolge (wichtig für Kollisionsfreiheit):
|
||||
(`>` / `<`) per Zeilen-Regex; `=` nur mit folgendem Leerraum (§3),
|
||||
die Faltmarke ebenso (siehe unten).
|
||||
3. URL: erstes Token, das auf `https?://\S+` passt (dadurch stören `@` in URLs nicht).
|
||||
4. Größe: erstes `(XS|S|M|L|XL|XXL)`, Groß-/Kleinschreibung egal.
|
||||
4. Größe: das **letzte** alleinstehend angesetzte `(XS|S|M|L|XL|XXL)`,
|
||||
Groß-/Kleinschreibung egal (siehe unten). Frühere Vorkommen bleiben im
|
||||
Label stehen.
|
||||
5. Tags: alle `@name`-Vorkommen.
|
||||
6. Knoten-ID: das **erste** alleinstehend angesetzte `#name`-Token (siehe unten).
|
||||
7. Abhängigkeiten: alle alleinstehend angesetzten `:#a,#b`-Token (siehe unten).
|
||||
@@ -84,6 +86,19 @@ Referenz-Regex (Schritt 1b, geprüft auf der kommentarfreien Zeile):
|
||||
Bild sagen dasselbe. Sie sagen nichts über Fortschritt (§4) oder
|
||||
Notwendigkeit (§3) und ändern weder Kosten noch Warnungen.
|
||||
|
||||
**Größe `(L)`** — die T-Shirt-Größe (§5) im Zeilenformat:
|
||||
|
||||
- Erkannt nur **alleinstehend angesetzt** (`(^|\s)\(…\)`, dieselbe Regel wie
|
||||
bei `#name` und `:#…`): `Backend(L)` bleibt damit ein Label, und die
|
||||
Zitier-Konventionen gelten auch hier — `"(L)"` und `((L))` bleiben Label,
|
||||
wer eine Größe **erwähnen** will, schreibt sie so.
|
||||
- Das **letzte** solche Token der Zeile ist die Größe; frühere Vorkommen
|
||||
bleiben im Label stehen (`Variante (L) bauen (M)` → Größe `M`, Label
|
||||
„Variante (L) bauen“). Die Größe steht nach der üblichen Schreibweise
|
||||
hinter dem Titel — das letzte Token ist die Angabe, alles davor ist Text.
|
||||
(Bis D68 galt das **erste** Token; die Umkehrung trifft nur Zeilen mit
|
||||
mehreren Kandidaten.)
|
||||
|
||||
**Knoten-ID `#name`** — benennt einen Knoten im **ganzen Dokument** eindeutig;
|
||||
sie ist die Adresse für Abhängigkeiten und Beschreibungsblöcke (§11).
|
||||
|
||||
@@ -201,6 +216,13 @@ sie setzt die Marke immer in die zweite Stellung und löst die erste dabei auf:
|
||||
^([ \t]*(?:[-|+]|=(?=[ \t]))?[ \t]*)(?:[><](?=[ \t])[ \t]*)?((?:\[[^\]]\][ \t]*)?)(?:[><](?=[ \t])[ \t]*)?
|
||||
```
|
||||
|
||||
Für die Größe (Schritt 4, nur der **letzte** Treffer; der führende Leerraum
|
||||
bleibt stehen):
|
||||
|
||||
```
|
||||
(^|\s)\((XXL|XS|XL|S|M|L)\)
|
||||
```
|
||||
|
||||
Für die Knoten-ID (Schritt 6, nur der erste Treffer; die letzte Gruppe ist der
|
||||
optionale Trenn-Doppelpunkt, der mit entfällt):
|
||||
|
||||
@@ -313,6 +335,8 @@ effektiv nicht weiter sein als das, was er braucht.
|
||||
## 5. Aufwand (T-Shirt-Größen)
|
||||
|
||||
- Werte: `XS < S < M < L < XL < XXL`, notiert in Klammern, z. B. `(L)`.
|
||||
Erkannt wird das letzte alleinstehend angesetzte Token der Zeile (§1) —
|
||||
`"(L)"` und `((L))` im Titel bleiben Text.
|
||||
- **Untergliederungsregel:** Ab `(M)` muss ein Element weiter zerlegt sein.
|
||||
Ein Element ≥ M **ohne Kinder** erhält einen Geister-Knoten an gestrichelter
|
||||
Linie darunter (in `--warn`, `#B45309`). Sein Label ist knapp „…“; die
|
||||
|
||||
Reference in New Issue
Block a user