PlayPendium
WordChess · 考えるための糧

1文字の数学

Qは10点、Eは1点。このひとつの事実の裏には、言語についての小さな理論と、情報をめぐる議論と、そしてこのゲームのタイルセットの中身がスペイン語と英語とで異なる理由が隠れています。

E · 1点 12 袋の中のタイル
対
Q · 10点 1 袋の中のタイル

英語で執筆・編集されました。この日本語版は機械翻訳によって作成されたものです。正確さが重要な箇所については、英語の原文が正式なものです。 英語の原文を読む →

01 · 建築家が新聞の一面を数える

点数とは希少性の測定値である

最初の手番で出会う採点ルールは、美的な選択ではありません。それは測定なのです。1930年代の初め、失業中の建築家Alfred Mosher Buttsは、純粋な運でも純粋な語彙力でもない単語ゲームを作ろうと思い立ち、各文字に値をつける筋の通った方法を必要としていました。そこで彼は技術者がすることをしました。数えたのです。Buttsは、当時の印刷物に各文字がどれほど頻繁に現れるかを集計しました。その筆頭はThe New York Timesの一面で、ほかにHerald TribuneやThe Saturday Evening Postもありました。1

その集計から、彼は2つの数を同時に読み取りました。個数、つまり各タイルを袋に何枚入れるかは、その文字が実際の文章でどれほどありふれているかに従います。点数はその逆をいきます。文字が珍しいほど、それを使う手は高く報われるべきなのです。ありふれた母音はわずか1点で、外来語や辞書の片隅にしか現れない文字はゲームの最高点を得ます。英語版ではその最高点は10点で、それを持つのはQとZだけです。BBCがかつて述べたように、Buttsは「各文字がNew York Timesの一面にどれほど頻繁に現れるかを測ることで、各タイルの値を算出した」のです。2

02 · 帳簿

3つの列で見る頻度

文字を並べてみると、設計の姿が見えてきます。現実世界での頻度が下がるにつれ、点数はほぼ単調に上がっていきます。Eはどこにでもあって安く、ZとQはほとんどどこにもなくて高価です。

英語のタイルセット:個数、点数、通常の文章における文字頻度
文字袋の中の枚数点数英語での頻度
E121≈ 12.7%
A91≈ 8.2%
N61≈ 6.7%
D42≈ 4.3%
B23≈ 1.5%
K15≈ 0.8%
X18≈ 0.15%
Q110≈ 0.12%
Z110≈ 0.07%

個数と点数は英語の標準セットのものです。3 頻度の数値は、通常の英文についての慣例的な推定値です。4 WordChessはこの伝統にならい、点数つきのタイルと、頻度で重みづけしたタイルセット(英語では100枚、文字タイル98枚とブランク2枚)を使っています。ただし、各プレイヤーは袋から引くのではなく、完全なセットをひとそろい持っています。ゲームの設計資料から計測。

03 · 設計の中の緊張

報われるほど珍しく、打てるほどありふれて

ここで、すっきりした発想が厳しい制約とぶつかります。点数が単に希少性に報いるものなら、理想の袋はQやZでいっぱいになり、莫大な点数が取られるのを待っていることになるでしょう。しかし袋は、実際にそこから手を打たなければならない手札でもあります。高得点の変わり種を7枚引いてしまえば、合法な単語をひとつも作れずに固まってしまいます。そのため個数は点数と引っ張り合います。袋には、言語がそれを使うのとおおよそ同じ比率で文字が入っていなければならず、さもなければゲームは行き詰まるのです。

だからこそQはちょうど1枚しかなく、Qとほとんど切り離せない相棒のUには専用のタイルが4枚与えられているのです。Qが1枚、そしてQがUに出会える見込みを与えるためのUが袋に4枚。ただ1枚のQが貴重なのは、それがほとんど使えないからこそであり、そもそも使えるのは、袋のほかのタイルが現実の言葉そのものの比率で配られているからにほかなりません。希少性が報酬を決め、頻度がゲームを動かし続けるのです。

タイルの値段は、その文字がどれほどまれに現れるかで決まりますが、袋の中身は、それがどれほど頻繁に現れるかで決まります。この2つの力は、同じ事実を前から読むか後ろから読むかの違いにすぎません。

04 · 22の言語、22のタイルセット

スペイン語がKを捨てる理由

公平なタイルセットがある言語の文字頻度を写した写真だとすれば、言語を変えれば写真も変わるはずです。実際、目に見えて変わります。WordChessは22の言語で動いており、言語ごとにタイルセットが作り直されます。英語に合わせて調整された分布は、ほかの言語ではまったく当てはまらないからです。3

北米以外で売られているスペイン語版のセットは、KとWを完全に外しています。これらの文字はスペイン語では外来語にしか現れないので、忠実な袋はそれらに1枚のタイルも与えないのです。5 イタリア語はさらに進んで、J、K、W、X、Yを省いています。これらはイタリア語本来の綴りに属さず、外来語にしか現れない文字です。5 英語の袋がそれぞれ1、2枚ずつに制限している文字は、別の言語では珍しいのではなく、存在しないのです。希少性は文字の性質ではありません。それはある言語における文字の性質なのです。

05 · 深い発想

文字の希少性とはその情報量である

Buttsは、それを表す言葉を持たないまま、ある数学者がおよそ15年後に定式化することになるものを測っていました。1948年、クロード・シャノン(Claude Shannon)は、ある明確な主張の上に情報理論を打ち立てました。記号は予測しにくいほど多くの情報を運ぶ、という主張です。推測できたはずの文字はほとんど何も教えてくれませんが、意外な文字は多くを教えてくれます。希少性とは情報そのものであり、情報はビットで測られます。6

1951年の論文Prediction and Entropy of Printed English(印刷された英語の予測とエントロピー)で、シャノンはその量を量ろうとしました。文字を個別に扱えば、英語は1文字あたりおよそ4ビットになります。しかし読み手に文脈を使わせると、つまりqのあとにはほぼ確実にuが来ること、vで終わる単語がほとんどないことなどを使わせると、実際の値は急落します。シャノンの予測実験は、通常の英語のエントロピーを1文字あたり0.6ビットから1.3ビットの間と見積もりました。6 私たちが書くものの大部分は冗長であり、本当の仕事をしているのは意外な文字なのです。

同じ勘定は、それ以前にある符号をすでに形づくっていました。1840年代にSamuel MorseとAlfred Vailが自分たちのアルファベットを作ったとき、Vailは印刷所の活字ケースを調べてどの文字が最もよく使われるかを知り、それらの文字に最も短い信号、つまりEには点ひとつ、Tには線ひとつを割り当てたと言われています。7 頻出する文字には短い符号を。ありふれたタイルには安い点数を。予測できるものには少ないビットを。Morseは電線上の時間を最小にし、Buttsはゲームの均衡をとり、シャノンはその根底にある数に名前を与えましたが、3人とも同じ帳簿を読んでいたのです。文字の価値とは、結局のところ、それがどれだけあなたを驚かせうるかの尺度だったのです。

Sources & notes
  1. Wikipedia, "Alfred Butts", on Butts deriving his letter counts and values from printed frequency counts: "Butts studied the front page of The New York Times to calculate how frequently each letter of the alphabet is used." Cites Bruce Lambert, "Alfred M. Butts, 93, Is Dead; Inventor of SCRABBLE", The New York Times, 7 April 1993. en.wikipedia.org/wiki/Alfred_Butts. The wider set of sources is from Wikipedia, "Scrabble" (History): Butts tabulated letters from a dictionary, the Saturday Evening Post, the New York Herald Tribune and The New York Times, citing John Tierney, "Humankind Battles for Scrabble Supremacy", The New York Times Magazine, 24 May 1998. en.wikipedia.org/wiki/Scrabble
  2. "Scrabble: Should letter values change?" BBC News Magazine (2013), on Q and Z as the English game’s ten-point tiles and on Butts, who “calculated a value for each tile by measuring how frequently each letter appeared on the front page of the New York Times.” bbc.com/news/magazine-20984707
  3. "Scrabble letter distributions." Wikipedia, the standard English tile counts and point values. en.wikipedia.org/wiki/Scrabble_letter_distributions
  4. Letter-frequency estimates for ordinary English text (E ≈ 12.7%, T ≈ 9.1%, …), as compiled in standard references. See "Letter frequency," Wikipedia. en.wikipedia.org/wiki/Letter_frequency
  5. "Scrabble letter distributions." Wikipedia, Spanish sets outside North America omit K and W; Italian sets omit J, K, W, X and Y, as these occur only in loanwords. en.wikipedia.org/wiki/Scrabble_letter_distributions
  6. Shannon, C. E. "Prediction and Entropy of Printed English." Bell System Technical Journal 30 (1951): 50–64. Estimates the entropy of English at roughly 0.6–1.3 bits per letter with context. princeton.edu/~wbialek/rome/refs/shannon_51.pdf
  7. Cook, J. D. "How efficient is Morse code?", on Morse and Vail assigning the shortest codes to the most frequent letters (E, T). johndcook.com/blog/2017/02/08/how-efficient-is-morse-code
  8. Further reading on Scrabble letter distributions, Scrabble as a tool for Haitian Creole literacy. doi.org.
  9. Further reading on Letter frequency, [1103.2950] Fitting Ranked English and Spanish Letter Frequency Distribution in U.S. and Mexican Presidential Speeches. arxiv.org.
Was this worth reading?
Play WordChess
PlayPendium · About · Contact · Privacy · Terms · Cookies · Accessibility · Copyright · Browse all games · Classic arcade games · © 2026