FA-80276 / Typography line breaking / Open access
Single-letter and unit bindings: unit binding direction · case 01
Units are separated from their numbers.
ROOT CAUSE
The unit test looks for a unit before a number instead of after it.
VERIFIED REPAIR
Bind a number to the unit that follows it.
Unsuccessful approach: Binding any word before a unit or after any number over-binds.
Case contract
Input [words, width]. A single-letter preposition/conjunction (a i o u v z k s w, any case) is bound to the following word, chaining; a number (digits with optional . or , decimal) is bound to a following unit (kg km cm mm % pt px). Bound groups are unbreakable; greedy fill of groups with unit spaces; an overwide group is set alone. Return lines.
Why this case matters
Line breaking decides where paragraphs wrap on screen and in print; a wrong decision point shifts every following line.
1 / The failure
Exit 1"""Failure Map reference implementation. Python standard library only."""
import json
N = 1
observations = []
def solve(x):
words, width = x
SINGLE = {'a', 'i', 'o', 'u', 'v', 'z', 'k', 's', 'w'}
UNITS = {'kg', 'km', 'cm', 'mm', '%', 'pt', 'px'}
groups = []
k = 0
while k < len(words):
grp = [words[k]]
while True:
last = grp[-1]
nxt = k + len(grp)
if nxt >= len(words):
break
number = last.replace('.', '').replace(',', '').isdigit()
if last.lower() in SINGLE or (words[nxt].replace('.', '').isdigit() and last in UNITS):
grp.append(words[nxt])
else:
break
groups.append(' '.join(grp))
k += len(grp)
lines, cur = [], ''
for g in groups:
cand = g if not cur else cur + ' ' + g
if len(cand) <= width or not cur:
cur = cand
else:
lines.append(cur)
cur = g
if cur:
lines.append(cur)
return lines
def check(label, actual, expected):
observations.append({"check": label, "actual": actual, "expected": expected, "passed": actual == expected})
fixtures = [[('decimal comma with unit', [['sazba', '1,5', 'cm', 'text'], 9], ['sazba', '1,5 cm', 'text']), ('regression: unit binding direction', [['domě', 'pt', 'a', 'a', 'z', 'sazba', 'v', 'domě', 'cm', 'a', '10', 'km'], 15], ['domě pt', 'a a z sazba', 'v domě cm', 'a 10 km']), ('partial-repair probe', [['i', 'i', '2.5', 'domě', 'V', 'o', 'km', 'V'], 11], ['i i 2.5', 'domě V o km', 'V']), ('regression: unit binding direction', [['1,5', 'kg', 's', 'sazba', '2.5', 'km', '10', 'pt', 'cm'], 6], ['1,5 kg', 's sazba', '2.5 km', '10 pt', 'cm']), ('sentence-initial V binds', [['V', 'Praze', 'text', 'sazba'], 8], ['V Praze', 'text', 'sazba']), ('chained singles', [['text', 'v', 'a', 'k', 'domě'], 10], ['text', 'v a k domě']), ('control layout', [['10', 'V', 'o', 'i', 'v', 'a'], 12], ['10 V o i v a']), ('control layout', [['o', 'k', 'řádek', 'V'], 9], ['o k řádek', 'V'])], [('regression: unit binding direction', [['domě', 'pt', 'a', 'a', 'z', 'sazba', 'v', 'domě', 'cm', 'a', '10', 'km'], 15], ['domě pt', 'a a z sazba', 'v domě cm', 'a 10 km']), ('regression: unit binding direction', [['o', 'km', 'pt', '10', 'kg', 'Praze', 'text', 'k', 'sazba'], 7], ['o km pt', '10 kg', 'Praze', 'text', 'k sazba']), ('partial-repair probe', [['V', '10', '2.5', 'v', 'o', 'Praze', 'text', '2.5'], 9], ['V 10 2.5', 'v o Praze', 'text 2.5']), ('partial-repair probe', [['V', 'o', 'km', 'pt', 'k', 'a', 's', '1,5', 'domě', '1,5'], 13], ['V o km pt', 'k a s 1,5', 'domě 1,5']), ('chained singles', [['text', 'v', 'a', 'k', 'domě'], 10], ['text', 'v a k domě']), ('sentence-initial V binds', [['V', 'Praze', 'text', 'sazba'], 8], ['V Praze', 'text', 'sazba']), ('control layout', [['sazba', 'kg', 'sazba', 'domě', 'domě', 'Praze', 'domě'], 13], ['sazba kg', 'sazba domě', 'domě Praze', 'domě']), ('control layout', [['km', 'a', 'text', 'i', 'km', 'z'], 8], ['km', 'a text', 'i km z'])], [('regression: unit binding direction', [['o', 'i', 'k', 'V', 'text', 'kg', '2.5', 'kg', 'cm'], 7], ['o i k V text', 'kg', '2.5 kg', 'cm']), ('regression: unit binding direction', [['řádek', 'km', '10', 'cm', 'text', 'v', 'sazba', 'domě', 'pt'], 9], ['řádek km', '10 cm', 'text', 'v sazba', 'domě pt']), ('partial-repair probe', [['pt', 'cm', 'pt', 'domě', 'Praze', 'k', 'V', 'text', 'z'], 7], ['pt cm', 'pt domě', 'Praze', 'k V text', 'z']), ('regression: unit binding direction', [['o', 'a', 's', 's', '1,5', 'cm', 'pt'], 7], ['o a s s 1,5 cm', 'pt']), ('decimal comma with unit', [['sazba', '1,5', 'cm', 'text'], 9], ['sazba', '1,5 cm', 'text']), ('chained singles', [['text', 'v', 'a', 'k', 'domě'], 10], ['text', 'v a k domě']), ('control layout', [['v', 'i', 'pt', 'V', 'V', 'km', 'v', 'pt', 'sazba', 'k', 's', 'pt'], 7], ['v i pt', 'V V km', 'v pt', 'sazba', 'k s pt']), ('control layout', [['k', 'sazba', 's', 'kg', 'i', 'řádek', 'řádek', 'řádek', 'V', 'text'], 16], ['k sazba s kg', 'i řádek řádek', 'řádek V text'])], [('regression: unit binding direction', [['10', 'i', 'a', 'pt', '10', 'domě', 'o', 'a', 'cm', 'a', 'sazba'], 9], ['10 i a pt', '10 domě', 'o a cm', 'a sazba']), ('regression: unit binding direction', [['text', 'km', '1,5', 'kg', 'km', 's', 'kg', '1,5', 'domě', 'cm'], 12], ['text km', '1,5 kg km', 's kg 1,5', 'domě cm']), ('partial-repair probe', [['cm', 'text', '1,5', '2.5'], 13], ['cm text 1,5', '2.5']), ('regression: unit binding direction', [['i', '2.5', 'pt', 'o', '1,5', 'o', 'i', 'V', 'pt', 'text', '2.5', 'km'], 7], ['i 2.5 pt', 'o 1,5', 'o i V pt', 'text', '2.5 km']), ('decimal comma with unit', [['sazba', '1,5', 'cm', 'text'], 9], ['sazba', '1,5 cm', 'text']), ('sentence-initial V binds', [['V', 'Praze', 'text', 'sazba'], 8], ['V Praze', 'text', 'sazba']), ('control layout', [['i', 'km', 'a', 'sazba', 'Praze', 'cm', 'z', 'kg'], 12], ['i km a sazba', 'Praze cm', 'z kg']), ('control layout', [['kg', 'řádek', 'v', 'kg', 'o', 'i', 'km', 's', 'domě', 'kg', 'V', '1,5'], 12], ['kg řádek', 'v kg o i km', 's domě kg', 'V 1,5'])], [('regression: unit binding direction', [['v', 'km', 'a', '10', 'pt', 'i', '1,5'], 11], ['v km', 'a 10 pt', 'i 1,5']), ('regression: unit binding direction', [['Praze', 'sazba', 'text', 'sazba', 'V', 'domě', '2.5', 'km', 'domě'], 12], ['Praze sazba', 'text sazba', 'V domě', '2.5 km domě']), ('partial-repair probe', [['V', '1,5', 'k', 'text', 'řádek', '2.5', 'v', 'kg'], 12], ['V 1,5 k text', 'řádek 2.5', 'v kg']), ('partial-repair probe', [['sazba', '1,5', 'a', 'sazba', '1,5'], 9], ['sazba 1,5', 'a sazba', '1,5']), ('chained singles', [['text', 'v', 'a', 'k', 'domě'], 10], ['text', 'v a k domě']), ('decimal comma with unit', [['sazba', '1,5', 'cm', 'text'], 9], ['sazba', '1,5 cm', 'text']), ('control layout', [['kg', 'a', 'sazba', 'domě', 'cm', 'řádek'], 9], ['kg', 'a sazba', 'domě cm', 'řádek']), ('control layout', [['i', 'a', 'i', 's', 'v', 'řádek', 'Praze'], 11], ['i a i s v řádek', 'Praze'])]]
for label, args, expected in fixtures[N - 1]:
check(label, solve(args), expected)
print(json.dumps({"observations": observations, "passed": all(x["passed"] for x in observations)}, ensure_ascii=False))
raise SystemExit(0 if all(x["passed"] for x in observations) else 1)
| Boundary fixture | Actual | Expected | Outcome |
|---|---|---|---|
| decimal comma with unit | ['sazba 1,5', 'cm text'] | ['sazba', '1,5 cm', 'text'] | Failed |
| regression: unit binding direction | ['domě pt', 'a a z sazba', 'v domě cm a 10', 'km'] | ['domě pt', 'a a z sazba', 'v domě cm', 'a 10 km'] | Failed |
| partial-repair probe | ['i i 2.5', 'domě V o km', 'V'] | ['i i 2.5', 'domě V o km', 'V'] | Passed |
| regression: unit binding direction | ['1,5 kg', 's sazba', '2.5', 'km 10', 'pt cm'] | ['1,5 kg', 's sazba', '2.5 km', '10 pt', 'cm'] | Failed |
| sentence-initial V binds | ['V Praze', 'text', 'sazba'] | ['V Praze', 'text', 'sazba'] | Passed |
| chained singles | ['text', 'v a k domě'] | ['text', 'v a k domě'] | Passed |
| control layout | ['10 V o i v a'] | ['10 V o i v a'] | Passed |
| control layout | ['o k řádek', 'V'] | ['o k řádek', 'V'] | Passed |
SHA-256 / 3fd0f419d8f570b99d4e856ea9907b6f98bb3c546de08a3d2ba4913ba0c10287
2 / The unsuccessful fix
Exit 1"""Failure Map reference implementation. Python standard library only."""
import json
N = 1
observations = []
def solve(x):
words, width = x
SINGLE = {'a', 'i', 'o', 'u', 'v', 'z', 'k', 's', 'w'}
UNITS = {'kg', 'km', 'cm', 'mm', '%', 'pt', 'px'}
groups = []
k = 0
while k < len(words):
grp = [words[k]]
while True:
last = grp[-1]
nxt = k + len(grp)
if nxt >= len(words):
break
number = last.replace('.', '').replace(',', '').isdigit()
if last.lower() in SINGLE or (number or words[nxt] in UNITS):
grp.append(words[nxt])
else:
break
groups.append(' '.join(grp))
k += len(grp)
lines, cur = [], ''
for g in groups:
cand = g if not cur else cur + ' ' + g
if len(cand) <= width or not cur:
cur = cand
else:
lines.append(cur)
cur = g
if cur:
lines.append(cur)
return lines
def check(label, actual, expected):
observations.append({"check": label, "actual": actual, "expected": expected, "passed": actual == expected})
fixtures = [[('decimal comma with unit', [['sazba', '1,5', 'cm', 'text'], 9], ['sazba', '1,5 cm', 'text']), ('regression: unit binding direction', [['domě', 'pt', 'a', 'a', 'z', 'sazba', 'v', 'domě', 'cm', 'a', '10', 'km'], 15], ['domě pt', 'a a z sazba', 'v domě cm', 'a 10 km']), ('partial-repair probe', [['i', 'i', '2.5', 'domě', 'V', 'o', 'km', 'V'], 11], ['i i 2.5', 'domě V o km', 'V']), ('regression: unit binding direction', [['1,5', 'kg', 's', 'sazba', '2.5', 'km', '10', 'pt', 'cm'], 6], ['1,5 kg', 's sazba', '2.5 km', '10 pt', 'cm']), ('sentence-initial V binds', [['V', 'Praze', 'text', 'sazba'], 8], ['V Praze', 'text', 'sazba']), ('chained singles', [['text', 'v', 'a', 'k', 'domě'], 10], ['text', 'v a k domě']), ('control layout', [['10', 'V', 'o', 'i', 'v', 'a'], 12], ['10 V o i v a']), ('control layout', [['o', 'k', 'řádek', 'V'], 9], ['o k řádek', 'V'])], [('regression: unit binding direction', [['domě', 'pt', 'a', 'a', 'z', 'sazba', 'v', 'domě', 'cm', 'a', '10', 'km'], 15], ['domě pt', 'a a z sazba', 'v domě cm', 'a 10 km']), ('regression: unit binding direction', [['o', 'km', 'pt', '10', 'kg', 'Praze', 'text', 'k', 'sazba'], 7], ['o km pt', '10 kg', 'Praze', 'text', 'k sazba']), ('partial-repair probe', [['V', '10', '2.5', 'v', 'o', 'Praze', 'text', '2.5'], 9], ['V 10 2.5', 'v o Praze', 'text 2.5']), ('partial-repair probe', [['V', 'o', 'km', 'pt', 'k', 'a', 's', '1,5', 'domě', '1,5'], 13], ['V o km pt', 'k a s 1,5', 'domě 1,5']), ('chained singles', [['text', 'v', 'a', 'k', 'domě'], 10], ['text', 'v a k domě']), ('sentence-initial V binds', [['V', 'Praze', 'text', 'sazba'], 8], ['V Praze', 'text', 'sazba']), ('control layout', [['sazba', 'kg', 'sazba', 'domě', 'domě', 'Praze', 'domě'], 13], ['sazba kg', 'sazba domě', 'domě Praze', 'domě']), ('control layout', [['km', 'a', 'text', 'i', 'km', 'z'], 8], ['km', 'a text', 'i km z'])], [('regression: unit binding direction', [['o', 'i', 'k', 'V', 'text', 'kg', '2.5', 'kg', 'cm'], 7], ['o i k V text', 'kg', '2.5 kg', 'cm']), ('regression: unit binding direction', [['řádek', 'km', '10', 'cm', 'text', 'v', 'sazba', 'domě', 'pt'], 9], ['řádek km', '10 cm', 'text', 'v sazba', 'domě pt']), ('partial-repair probe', [['pt', 'cm', 'pt', 'domě', 'Praze', 'k', 'V', 'text', 'z'], 7], ['pt cm', 'pt domě', 'Praze', 'k V text', 'z']), ('regression: unit binding direction', [['o', 'a', 's', 's', '1,5', 'cm', 'pt'], 7], ['o a s s 1,5 cm', 'pt']), ('decimal comma with unit', [['sazba', '1,5', 'cm', 'text'], 9], ['sazba', '1,5 cm', 'text']), ('chained singles', [['text', 'v', 'a', 'k', 'domě'], 10], ['text', 'v a k domě']), ('control layout', [['v', 'i', 'pt', 'V', 'V', 'km', 'v', 'pt', 'sazba', 'k', 's', 'pt'], 7], ['v i pt', 'V V km', 'v pt', 'sazba', 'k s pt']), ('control layout', [['k', 'sazba', 's', 'kg', 'i', 'řádek', 'řádek', 'řádek', 'V', 'text'], 16], ['k sazba s kg', 'i řádek řádek', 'řádek V text'])], [('regression: unit binding direction', [['10', 'i', 'a', 'pt', '10', 'domě', 'o', 'a', 'cm', 'a', 'sazba'], 9], ['10 i a pt', '10 domě', 'o a cm', 'a sazba']), ('regression: unit binding direction', [['text', 'km', '1,5', 'kg', 'km', 's', 'kg', '1,5', 'domě', 'cm'], 12], ['text km', '1,5 kg km', 's kg 1,5', 'domě cm']), ('partial-repair probe', [['cm', 'text', '1,5', '2.5'], 13], ['cm text 1,5', '2.5']), ('regression: unit binding direction', [['i', '2.5', 'pt', 'o', '1,5', 'o', 'i', 'V', 'pt', 'text', '2.5', 'km'], 7], ['i 2.5 pt', 'o 1,5', 'o i V pt', 'text', '2.5 km']), ('decimal comma with unit', [['sazba', '1,5', 'cm', 'text'], 9], ['sazba', '1,5 cm', 'text']), ('sentence-initial V binds', [['V', 'Praze', 'text', 'sazba'], 8], ['V Praze', 'text', 'sazba']), ('control layout', [['i', 'km', 'a', 'sazba', 'Praze', 'cm', 'z', 'kg'], 12], ['i km a sazba', 'Praze cm', 'z kg']), ('control layout', [['kg', 'řádek', 'v', 'kg', 'o', 'i', 'km', 's', 'domě', 'kg', 'V', '1,5'], 12], ['kg řádek', 'v kg o i km', 's domě kg', 'V 1,5'])], [('regression: unit binding direction', [['v', 'km', 'a', '10', 'pt', 'i', '1,5'], 11], ['v km', 'a 10 pt', 'i 1,5']), ('regression: unit binding direction', [['Praze', 'sazba', 'text', 'sazba', 'V', 'domě', '2.5', 'km', 'domě'], 12], ['Praze sazba', 'text sazba', 'V domě', '2.5 km domě']), ('partial-repair probe', [['V', '1,5', 'k', 'text', 'řádek', '2.5', 'v', 'kg'], 12], ['V 1,5 k text', 'řádek 2.5', 'v kg']), ('partial-repair probe', [['sazba', '1,5', 'a', 'sazba', '1,5'], 9], ['sazba 1,5', 'a sazba', '1,5']), ('chained singles', [['text', 'v', 'a', 'k', 'domě'], 10], ['text', 'v a k domě']), ('decimal comma with unit', [['sazba', '1,5', 'cm', 'text'], 9], ['sazba', '1,5 cm', 'text']), ('control layout', [['kg', 'a', 'sazba', 'domě', 'cm', 'řádek'], 9], ['kg', 'a sazba', 'domě cm', 'řádek']), ('control layout', [['i', 'a', 'i', 's', 'v', 'řádek', 'Praze'], 11], ['i a i s v řádek', 'Praze'])]]
for label, args, expected in fixtures[N - 1]:
check(label, solve(args), expected)
print(json.dumps({"observations": observations, "passed": all(x["passed"] for x in observations)}, ensure_ascii=False))
raise SystemExit(0 if all(x["passed"] for x in observations) else 1)
| Boundary fixture | Actual | Expected | Outcome |
|---|---|---|---|
| decimal comma with unit | ['sazba', '1,5 cm', 'text'] | ['sazba', '1,5 cm', 'text'] | Passed |
| regression: unit binding direction | ['domě pt', 'a a z sazba', 'v domě cm', 'a 10 km'] | ['domě pt', 'a a z sazba', 'v domě cm', 'a 10 km'] | Passed |
| partial-repair probe | ['i i 2.5 domě', 'V o km V'] | ['i i 2.5', 'domě V o km', 'V'] | Failed |
| regression: unit binding direction | ['1,5 kg', 's sazba', '2.5 km', '10 pt cm'] | ['1,5 kg', 's sazba', '2.5 km', '10 pt', 'cm'] | Failed |
| sentence-initial V binds | ['V Praze', 'text', 'sazba'] | ['V Praze', 'text', 'sazba'] | Passed |
| chained singles | ['text', 'v a k domě'] | ['text', 'v a k domě'] | Passed |
| control layout | ['10 V o i v a'] | ['10 V o i v a'] | Passed |
| control layout | ['o k řádek', 'V'] | ['o k řádek', 'V'] | Passed |
SHA-256 / cff6dc2816601e2909bc4934d8b9117158907ff5c77cda3142287d7ce9e99bfa
3 / The verified repair
Exit 0"""Failure Map reference implementation. Python standard library only."""
import json
N = 1
observations = []
def solve(x):
words, width = x
SINGLE = {'a', 'i', 'o', 'u', 'v', 'z', 'k', 's', 'w'}
UNITS = {'kg', 'km', 'cm', 'mm', '%', 'pt', 'px'}
groups = []
k = 0
while k < len(words):
grp = [words[k]]
while True:
last = grp[-1]
nxt = k + len(grp)
if nxt >= len(words):
break
number = last.replace('.', '').replace(',', '').isdigit()
if last.lower() in SINGLE or (number and words[nxt] in UNITS):
grp.append(words[nxt])
else:
break
groups.append(' '.join(grp))
k += len(grp)
lines, cur = [], ''
for g in groups:
cand = g if not cur else cur + ' ' + g
if len(cand) <= width or not cur:
cur = cand
else:
lines.append(cur)
cur = g
if cur:
lines.append(cur)
return lines
def check(label, actual, expected):
observations.append({"check": label, "actual": actual, "expected": expected, "passed": actual == expected})
fixtures = [[('decimal comma with unit', [['sazba', '1,5', 'cm', 'text'], 9], ['sazba', '1,5 cm', 'text']), ('regression: unit binding direction', [['domě', 'pt', 'a', 'a', 'z', 'sazba', 'v', 'domě', 'cm', 'a', '10', 'km'], 15], ['domě pt', 'a a z sazba', 'v domě cm', 'a 10 km']), ('partial-repair probe', [['i', 'i', '2.5', 'domě', 'V', 'o', 'km', 'V'], 11], ['i i 2.5', 'domě V o km', 'V']), ('regression: unit binding direction', [['1,5', 'kg', 's', 'sazba', '2.5', 'km', '10', 'pt', 'cm'], 6], ['1,5 kg', 's sazba', '2.5 km', '10 pt', 'cm']), ('sentence-initial V binds', [['V', 'Praze', 'text', 'sazba'], 8], ['V Praze', 'text', 'sazba']), ('chained singles', [['text', 'v', 'a', 'k', 'domě'], 10], ['text', 'v a k domě']), ('control layout', [['10', 'V', 'o', 'i', 'v', 'a'], 12], ['10 V o i v a']), ('control layout', [['o', 'k', 'řádek', 'V'], 9], ['o k řádek', 'V'])], [('regression: unit binding direction', [['domě', 'pt', 'a', 'a', 'z', 'sazba', 'v', 'domě', 'cm', 'a', '10', 'km'], 15], ['domě pt', 'a a z sazba', 'v domě cm', 'a 10 km']), ('regression: unit binding direction', [['o', 'km', 'pt', '10', 'kg', 'Praze', 'text', 'k', 'sazba'], 7], ['o km pt', '10 kg', 'Praze', 'text', 'k sazba']), ('partial-repair probe', [['V', '10', '2.5', 'v', 'o', 'Praze', 'text', '2.5'], 9], ['V 10 2.5', 'v o Praze', 'text 2.5']), ('partial-repair probe', [['V', 'o', 'km', 'pt', 'k', 'a', 's', '1,5', 'domě', '1,5'], 13], ['V o km pt', 'k a s 1,5', 'domě 1,5']), ('chained singles', [['text', 'v', 'a', 'k', 'domě'], 10], ['text', 'v a k domě']), ('sentence-initial V binds', [['V', 'Praze', 'text', 'sazba'], 8], ['V Praze', 'text', 'sazba']), ('control layout', [['sazba', 'kg', 'sazba', 'domě', 'domě', 'Praze', 'domě'], 13], ['sazba kg', 'sazba domě', 'domě Praze', 'domě']), ('control layout', [['km', 'a', 'text', 'i', 'km', 'z'], 8], ['km', 'a text', 'i km z'])], [('regression: unit binding direction', [['o', 'i', 'k', 'V', 'text', 'kg', '2.5', 'kg', 'cm'], 7], ['o i k V text', 'kg', '2.5 kg', 'cm']), ('regression: unit binding direction', [['řádek', 'km', '10', 'cm', 'text', 'v', 'sazba', 'domě', 'pt'], 9], ['řádek km', '10 cm', 'text', 'v sazba', 'domě pt']), ('partial-repair probe', [['pt', 'cm', 'pt', 'domě', 'Praze', 'k', 'V', 'text', 'z'], 7], ['pt cm', 'pt domě', 'Praze', 'k V text', 'z']), ('regression: unit binding direction', [['o', 'a', 's', 's', '1,5', 'cm', 'pt'], 7], ['o a s s 1,5 cm', 'pt']), ('decimal comma with unit', [['sazba', '1,5', 'cm', 'text'], 9], ['sazba', '1,5 cm', 'text']), ('chained singles', [['text', 'v', 'a', 'k', 'domě'], 10], ['text', 'v a k domě']), ('control layout', [['v', 'i', 'pt', 'V', 'V', 'km', 'v', 'pt', 'sazba', 'k', 's', 'pt'], 7], ['v i pt', 'V V km', 'v pt', 'sazba', 'k s pt']), ('control layout', [['k', 'sazba', 's', 'kg', 'i', 'řádek', 'řádek', 'řádek', 'V', 'text'], 16], ['k sazba s kg', 'i řádek řádek', 'řádek V text'])], [('regression: unit binding direction', [['10', 'i', 'a', 'pt', '10', 'domě', 'o', 'a', 'cm', 'a', 'sazba'], 9], ['10 i a pt', '10 domě', 'o a cm', 'a sazba']), ('regression: unit binding direction', [['text', 'km', '1,5', 'kg', 'km', 's', 'kg', '1,5', 'domě', 'cm'], 12], ['text km', '1,5 kg km', 's kg 1,5', 'domě cm']), ('partial-repair probe', [['cm', 'text', '1,5', '2.5'], 13], ['cm text 1,5', '2.5']), ('regression: unit binding direction', [['i', '2.5', 'pt', 'o', '1,5', 'o', 'i', 'V', 'pt', 'text', '2.5', 'km'], 7], ['i 2.5 pt', 'o 1,5', 'o i V pt', 'text', '2.5 km']), ('decimal comma with unit', [['sazba', '1,5', 'cm', 'text'], 9], ['sazba', '1,5 cm', 'text']), ('sentence-initial V binds', [['V', 'Praze', 'text', 'sazba'], 8], ['V Praze', 'text', 'sazba']), ('control layout', [['i', 'km', 'a', 'sazba', 'Praze', 'cm', 'z', 'kg'], 12], ['i km a sazba', 'Praze cm', 'z kg']), ('control layout', [['kg', 'řádek', 'v', 'kg', 'o', 'i', 'km', 's', 'domě', 'kg', 'V', '1,5'], 12], ['kg řádek', 'v kg o i km', 's domě kg', 'V 1,5'])], [('regression: unit binding direction', [['v', 'km', 'a', '10', 'pt', 'i', '1,5'], 11], ['v km', 'a 10 pt', 'i 1,5']), ('regression: unit binding direction', [['Praze', 'sazba', 'text', 'sazba', 'V', 'domě', '2.5', 'km', 'domě'], 12], ['Praze sazba', 'text sazba', 'V domě', '2.5 km domě']), ('partial-repair probe', [['V', '1,5', 'k', 'text', 'řádek', '2.5', 'v', 'kg'], 12], ['V 1,5 k text', 'řádek 2.5', 'v kg']), ('partial-repair probe', [['sazba', '1,5', 'a', 'sazba', '1,5'], 9], ['sazba 1,5', 'a sazba', '1,5']), ('chained singles', [['text', 'v', 'a', 'k', 'domě'], 10], ['text', 'v a k domě']), ('decimal comma with unit', [['sazba', '1,5', 'cm', 'text'], 9], ['sazba', '1,5 cm', 'text']), ('control layout', [['kg', 'a', 'sazba', 'domě', 'cm', 'řádek'], 9], ['kg', 'a sazba', 'domě cm', 'řádek']), ('control layout', [['i', 'a', 'i', 's', 'v', 'řádek', 'Praze'], 11], ['i a i s v řádek', 'Praze'])]]
for label, args, expected in fixtures[N - 1]:
check(label, solve(args), expected)
print(json.dumps({"observations": observations, "passed": all(x["passed"] for x in observations)}, ensure_ascii=False))
raise SystemExit(0 if all(x["passed"] for x in observations) else 1)
| Boundary fixture | Actual | Expected | Outcome |
|---|---|---|---|
| decimal comma with unit | ['sazba', '1,5 cm', 'text'] | ['sazba', '1,5 cm', 'text'] | Passed |
| regression: unit binding direction | ['domě pt', 'a a z sazba', 'v domě cm', 'a 10 km'] | ['domě pt', 'a a z sazba', 'v domě cm', 'a 10 km'] | Passed |
| partial-repair probe | ['i i 2.5', 'domě V o km', 'V'] | ['i i 2.5', 'domě V o km', 'V'] | Passed |
| regression: unit binding direction | ['1,5 kg', 's sazba', '2.5 km', '10 pt', 'cm'] | ['1,5 kg', 's sazba', '2.5 km', '10 pt', 'cm'] | Passed |
| sentence-initial V binds | ['V Praze', 'text', 'sazba'] | ['V Praze', 'text', 'sazba'] | Passed |
| chained singles | ['text', 'v a k domě'] | ['text', 'v a k domě'] | Passed |
| control layout | ['10 V o i v a'] | ['10 V o i v a'] | Passed |
| control layout | ['o k řádek', 'V'] | ['o k řádek', 'V'] | Passed |
SHA-256 / 7ba276c9fe4b658ad127fb483f0ee5ddc594cdd821ee72ae3591a0df6134246b
Verification & scope
A deterministic toy typesetting model with integer widths and a stipulated rule set; it does not claim conformance to any engine. This reproducer isolates one failure mechanism. Results cover the supplied fixtures. Variants within a family share a test contract and should remain grouped when constructing evaluation splits. Related mechanisms with a shared evaluation_group must also remain together; these controlled models are not independent production incidents.
Observations recorded using Python 3.12.14 at 2026-09-29T14:49:52.283832+00:00.
Case digest / e0d3c8c703529ef6c079c5e791b629e45f07269b5c0da2d32d7e9ab4ea059f7f