PlayPendium
WordChess · Nahrung für den Geist

Die Mathematik eines Buchstabens

Q ist zehn Punkte wert und E einen Punkt. Diese eine Tatsache verbirgt eine kleine Theorie der Sprache, ein Argument über Information und einen Grund, warum der Kachelsatz des Spiels auf Spanisch anders aussieht als auf Englisch.

E · ein Punkt 12 Kacheln im Beutel
versus
Q · zehn Punkte 1 Kachel im Beutel

Auf Englisch verfasst und redigiert. Diese deutsche Fassung wurde maschinell übersetzt; wo es auf Genauigkeit ankommt, ist das englische Original maßgeblich. Das englische Original lesen →

01 · Ein Architekt zählt die Titelseite

Ein Wert ist ein Maß für Knappheit

Die Punkteregel, der Sie in Ihrem ersten Zug begegnen, ist keine ästhetische Wahl. Sie ist ein Messwert. In den frühen 1930er-Jahren unternahm der arbeitslose Architekt Alfred Mosher Butts den Versuch, ein Wortspiel zu bauen, das weder reines Glück noch reines Vokabular war, und er brauchte eine begründete Methode, um jeden Buchstaben zu bewerten. Also tat er, was ein Ingenieur tut: Er zählte. Butts erfasste, wie oft jeder Buchstabe in den gedruckten Quellen seiner Zeit auftrat, vor allem auf der Titelseite der New York Times, dazu in der Herald Tribune und der Saturday Evening Post. 1

Aus diesen Zählungen las er zwei Zahlen gleichzeitig ab. Die Anzahl, wie viele Kacheln von jedem Buchstaben in den Beutel kommen, spiegelt wider, wie häufig der Buchstabe in der tatsächlichen Schriftsprache ist. Der Wert verläuft in die andere Richtung: Je seltener der Buchstabe, desto mehr sollte ein Zug, der ihn verwendet, einbringen. Häufige Vokale erbringen einen einzelnen Punkt; die Buchstaben, die nur in Lehnwörtern und unwegsamen Ecken des Wörterbuchs auftauchen, erbringen das Maximum des Spiels. Im englischen Spiel liegt dieses Maximum bei zehn Punkten, und nur Q und Z tragen es; wie die BBC einst schrieb, „berechnete“ Butts „einen Wert für jede Kachel, indem er maß, wie häufig jeder Buchstabe auf der Titelseite der New York Times vorkam“. 2

02 · Die Aufstellung

Häufigkeit in drei Spalten

Ordnen Sie die Buchstaben an, und das Design offenbart sich. Der Punktwert steigt fast monoton, während die reale Häufigkeit fällt. E ist überall und billig; Z und Q sind fast nirgends und teuer.

Englischer Kachelsatz, Anzahl, Wert und Buchstabenhäufigkeit in gewöhnlichem Text
BuchstabeKacheln im BeutelPunktwertHäuf. im Englischen
E121≈ 12.7%
A91≈ 8.2%
N61≈ 6.7%
D42≈ 4.3%
B23≈ 1.5%
K15≈ 0.8%
X18≈ 0.15%
Q110≈ 0.12%
Z110≈ 0.07%

Die Anzahlen und Werte entsprechen dem englischen Standardsatz; 3 die Häufigkeitswerte sind die üblichen Schätzungen für gewöhnlichen englischen Text. 4 WordChess verwendet in dieser Tradition Kacheln mit Punktwerten und einen häufigkeitsgewichteten Kachelsatz (auf Englisch 100 Kacheln, 98 Buchstaben und 2 Blanko-Kacheln), wobei jedoch jeder Spieler einen vollständigen Satz hält, statt aus einem Beutel zu ziehen, gemessen aus den Design-Dokumenten des Spiels.

03 · Die Spannung im Design

Selten genug, um belohnt zu werden, häufig genug, um gespielt zu werden

Hier trifft eine klare Idee auf eine harte Einschränkung. Wenn der Wert einfach nur die Seltenheit belohnen würde, wäre der ideale Beutel voller Qs und Zs, enorme Punkte, darauf wartend, beansprucht zu werden. Aber ein Beutel ist auch eine Hand, aus der Sie tatsächlich spielen müssen. Ziehen Sie sieben hochwertige Kuriositäten, und Sie sitzen gefroren da, unfähig, ein legales Wort zu bilden. Also zieht die Anzahl gegen den Wert: Der Beutel muss die Buchstaben in etwa dem Verhältnis halten, in dem die Sprache sie verwendet, oder das Spiel stockt.

Deshalb gibt es genau ein Q, und deshalb erhält sein fast untrennbarer Partner U vier eigene Kacheln: ein Q und vier U im Beutel, damit es eine Chance hat, eines davon zu finden. Das einzelne Q ist kostbar, weil es fast unspielbar ist, und überhaupt nur spielbar, weil die anderen Kacheln des Beutels in den Proportionen des Lebens verteilt wurden. Knappheit setzt die Belohnung; Häufigkeit hält das Spiel in Bewegung.

Der Preis einer Kachel wird dadurch festgelegt, wie selten der Buchstabe auftritt, aber der Inhalt des Beutels wird dadurch festgelegt, wie oft er es tut. Die beiden Kräfte sind dieselbe Tatsache, vorwärts und rückwärts gelesen.

04 · Zweiundzwanzig Sprachen, zweiundzwanzig Kachelsätze

Warum das Spanische das K wegwirft

Wenn ein fairer Kachelsatz ein Foto der Buchstabenhäufigkeiten einer Sprache ist, dann muss ein Wechsel der Sprache auch das Foto verändern. Und das tut er, sichtbar. WordChess läuft in 22 Sprachen, und sein Kachelsatz wird für jede neu zusammengestellt, weil eine auf Englisch abgestimmte Verteilung anderswo schlicht falsch ist. 3

Spanische Sätze, die außerhalb Nordamerikas verkauft werden, streichen K und W vollständig; diese Buchstaben erscheinen im Spanischen nur in importierten Wörtern, also gibt ein getreuer Beutel ihnen gar keine Kacheln. 5 Italienisch geht noch weiter und lässt J, K, W, X und Y aus, Buchstaben, die nicht zur einheimischen italienischen Rechtschreibung gehören und nur in Lehnwörtern auftauchen. 5 Buchstaben, die der englische Beutel auf je ein oder zwei Kacheln rationiert, sind in einer anderen Sprache nicht selten, sondern abwesend. Seltenheit ist keine Eigenschaft eines Buchstabens. Sie ist eine Eigenschaft eines Buchstabens in einer Sprache.

05 · Der tiefe Gedanke

Die Seltenheit eines Buchstaben ist seine Information

Butts maß, ohne das Vokabular dafür zu haben, etwas, das ein Mathematiker etwa fünfzehn Jahre später formalisieren würde. 1948 gründete Claude Shannon die Informationstheorie auf einer präzisen Behauptung: Je weniger vorhersehbar ein Symbol ist, desto mehr Information trägt es. Ein Buchstabe, den man hätte raten können, verrät wenig; ein überraschender verrät viel. Seltenheit ist Information, und Information wird in Bits gemessen. 6

In seinem 1951 erschienenen Papier Prediction and Entropy of Printed English unternahm Shannon den Versuch, diese Größe zu wiegen. Behandelt man Buchstaben isoliert, beläuft sich Englisch auf etwa vier Bits pro Buchstabe; aber lässt man einen Leser Kontext nutzen, die Tatsache, dass ein q fast ein u verspricht, dass wenige Wörter auf v enden, und die wahre Rate bricht ein. Shannons Vorhersageexperimente setzten die Entropie des gewöhnlichen Englisch irgendwo zwischen 0,6 und 1,3 Bits pro Buchstabe an. 6 Das meiste, was wir schreiben, ist redundant; die überraschenden Buchstaben leisten die eigentliche Arbeit.

Dasselbe Abrechnungsverfahren hatte bereits einen früheren Code geformt. Als Samuel Morse und Alfred Vail in den 1840er Jahren ihr Alphabet bauten, soll Vail die Schriftkästen einer Druckerei studiert haben, um zu lernen, welche Buchstaben am häufigsten verwendet wurden, und dann diesen Buchstaben die kürzesten Signale zugeordnet haben, einen einzelnen Punkt für E, einen einzelnen Strich für T. 7 Kurze Codes für häufige Buchstaben; billige Punkte für gemeinsame Kacheln; wenige Bits für das Vorhersehbare. Morse minimierte die Zeit auf einem Draht, Butts balancierte ein Spiel, Shannon nannte die zugrunde liegende Zahl, aber alle drei lasen dasselbe Buch. Der Wert eines Buchstaben war, wie sich herausstellte, immer ein Maß dafür, wie sehr er Sie überraschen konnte.

Sources & notes
  1. Wikipedia, "Alfred Butts", on Butts deriving his letter counts and values from printed frequency counts: "Butts studied the front page of The New York Times to calculate how frequently each letter of the alphabet is used." Cites Bruce Lambert, "Alfred M. Butts, 93, Is Dead; Inventor of SCRABBLE", The New York Times, 7 April 1993. en.wikipedia.org/wiki/Alfred_Butts. The wider set of sources is from Wikipedia, "Scrabble" (History): Butts tabulated letters from a dictionary, the Saturday Evening Post, the New York Herald Tribune and The New York Times, citing John Tierney, "Humankind Battles for Scrabble Supremacy", The New York Times Magazine, 24 May 1998. en.wikipedia.org/wiki/Scrabble
  2. "Scrabble: Should letter values change?" BBC News Magazine (2013), on Q and Z as the English game’s ten-point tiles and on Butts, who “calculated a value for each tile by measuring how frequently each letter appeared on the front page of the New York Times.” bbc.com/news/magazine-20984707
  3. "Scrabble letter distributions." Wikipedia, the standard English tile counts and point values. en.wikipedia.org/wiki/Scrabble_letter_distributions
  4. Letter-frequency estimates for ordinary English text (E ≈ 12.7%, T ≈ 9.1%, …), as compiled in standard references. See "Letter frequency," Wikipedia. en.wikipedia.org/wiki/Letter_frequency
  5. "Scrabble letter distributions." Wikipedia, Spanish sets outside North America omit K and W; Italian sets omit J, K, W, X and Y, as these occur only in loanwords. en.wikipedia.org/wiki/Scrabble_letter_distributions
  6. Shannon, C. E. "Prediction and Entropy of Printed English." Bell System Technical Journal 30 (1951): 50–64. Estimates the entropy of English at roughly 0.6–1.3 bits per letter with context. princeton.edu/~wbialek/rome/refs/shannon_51.pdf
  7. Cook, J. D. "How efficient is Morse code?", on Morse and Vail assigning the shortest codes to the most frequent letters (E, T). johndcook.com/blog/2017/02/08/how-efficient-is-morse-code
  8. Further reading on Scrabble letter distributions, Scrabble as a tool for Haitian Creole literacy. doi.org.
  9. Further reading on Letter frequency, [1103.2950] Fitting Ranked English and Spanish Letter Frequency Distribution in U.S. and Mexican Presidential Speeches. arxiv.org.
Was this worth reading?
Play WordChess
PlayPendium · About · Contact · Privacy · Terms · Cookies · Accessibility · Copyright · Browse all games · Classic arcade games · © 2026