1. 文字はいくつあるのか、そしてなぜ分けて見るのか
世界の文字の数を数えるうえで最も実用的な基準は、コンピューターが使う国際標準のユニコードです。ユニコードコンソーシアムは2025年9月9日に17.0バージョンを公開し、新しい文字4,803字を追加して合計159,801文字を登録し、文字体系(スクリプト)の数は172になったと発表しました。今回新たに加わった四つの文字体系は、中央アフリカのザガワ共同体が使う現代文字ベリア・エルペ、インド北東部クルク共同体のトロン・シキ、ベトナム北部のタイ・ヨ共同体の伝統文字、そして古代アナトリアで使われたシデ文字です。文字は博物館の中にだけあるのではなく、今も作られ、標準に登録されていく生きた道具なのです。
172の文字体系を一列に並べても覚えられませんが、音を書き表す方式でまとめると、いくつかの系統に整理できます。子音と母音をそれぞれ一つの文字で書くアルファベット、子音だけを書いて母音はおおむね省略するアブジャド、子音字そのものに基本の母音が含まれ、ほかの母音は符号で置き換えるアブギダ、1音節を1文字で書く音節文字、そして意味を持つ単位を文字とする表語文字です。この分類は文字の「良し悪し」ではなく、それぞれの言語の音の構造に合わせて人々が選び取った、異なる解法を示しています。
2. アルファベットの誕生:数百の記号を20余りに
ペンシルベニア大学博物館の説明によれば、アルファベットはエジプトの象形文字から着想を得たフェニキア人の先祖であるカナン人が、早ければ紀元前1800年頃に発明したもので、近年シリアのウンム・エルマラで発見された粘土の銘板は紀元前2400〜2300年まで年代が遡る可能性があります。アルファベットの最も重要な利点は、文字の数でした。楔形文字や象形文字の数百もの記号の代わりに、「アルファベット文字の学習者は20から30の文字だけ学べば」よいことになったのです。
同じ資料は、最も古いギリシャ・アルファベットの銘文が、フェニキアの船が地中海を行き交っていた紀元前700年代のものであり、今日の英語や多くの言語で使われるラテン・アルファベットがギリシャ・アルファベットから発展したと説明しています。フェニキア文字が子音だけを書く体系であり、ギリシャ人が一部の文字を母音表記に振り直したという説明は広く知られていますが、本稿が確認した博物館の資料はその細かな過程までは扱っていないため、ここでは結果だけを記します。ギリシャ・ラテンのアルファベットは子音と母音をどちらも一つの文字で書く体系となり、その方式が今日、世界で最も広く使われる文字の類型になりました。
3. アブジャド:アラビア文字はなぜ母音を省くのか
アラビア文字は子音中心の文字、すなわちアブジャドの代表例です。W3Cの国際化活動に参加するリチャード・イシダによるアラビア文字の正書法ノートは、アラビア文字を「短母音が通常は書かれない」アブジャドだと説明しています。基本の子音字は28個で、文章は右から左へ横書きしますが、数字や挿入されたラテン文字は左から右へ読むため、一行の中で方向が混ざります。文字は常に続けて書く筆記体で、前後に何が来るかによって形が変わります。
母音がないわけではありません。長母音はアリフ・ワーウ・ヤーという三つの文字が母音の役割を兼ねて示し、短母音は文字の上下に付く小さな符号(ハラカート)で書くことができます。ただしこの符号は「クルアーンの本文、辞書、教育資料、発音を明確にする必要がある場面」でのみ使われ、日常の印刷物ではほとんど省略されます。読む人が言語を知っているため、子音の骨組みだけで単語を見分けられる仕組みです。同じ文字はペルシア語やウルドゥー語、いくつものアフリカの言語でも、それぞれの言語の音に合わせて文字を加えながら使われており、文字と言語が一対一ではないことを示す事例でもあります。
4. アブギダ:子音字の中に母音が入っている
インドのデーヴァナーガリーをはじめとする南アジアの文字は、ユニコードの技術ノートが「アブギダまたはアルファシラバリー」と呼ぶ類型です。このノートによれば、この類型では「子音字が子音+母音の音節を表し」、子音には基本として付属する母音(内在母音)があるため、別の母音の音が必要なときはそれを上書きしなければなりません。内在母音の実際の発音は文字ごとに異なり、/ə/、/ʌ/、/ɔ/ といった例があります。内在母音以外の母音を書くときは、サンスクリット語でマートラーと呼ばれる母音符号を子音の左・右・上・下に、ときには複数の方向へ同時に付け、母音なしで子音だけを発音しなければならないときは、ユニコードでヴィラーマと呼ばれる小さな符号で内在母音を「殺し」ます。子音が連続するときは文字の形を変えたり合わせたりしますが、デーヴァナーガリーの結合字の60%では、内在母音の音と歴史的に結びついた縦画が消える半字の形が使われます。ノートは、これらの文字がすべてブラーフミーという共通の祖先から分かれ出たものだと説明しています。
アフリカには別のアブギダがあります。ユニコード標準のコア仕様は、エチオピア文字を「子音と母音の組み合わせを二次元の行列として示す」伝統を持つ文字だと説明し、エンコーディングもその構造に従って、43の子音と8の母音を掛け合わせた344の概念的な音節で組まれていると記しています。この文字の名の由来となったゲエズ語は、今では礼拝の言語としてのみ残っていますが、文字そのものはアムハラ語・ティグレ語・オロモ語など東アフリカの多くの言語に採用されて使われています。同じ文書は、アフリカで近代に新しく作られた文字も記録しています。西アフリカのマンデ系言語を書くために1949年に作られ、右から左へ書くンコ文字、1830年代に作られて1962年に標準音節表が出たリベリア・シエラレオネのヴァイ音節文字、1896〜1910年の間にカメルーン西部で作られたバムン音節文字がその例です。
5. 音節文字と表語文字を併用する日本語
日本語は一つの文の中で三種類の文字をともに使います。意味を持つ単位を書く漢字、そして1音節を1文字で書く二種類の仮名(ひらがな・カタカナ)です。漢字はどれくらい知っておくべきなのでしょうか。日本の文化庁は、2010年(平成22年)に内閣告示で改定した「常用漢字表」に2,136字を収め、この表の性格を「一般の社会生活における漢字使用の目安」と説明しています。つまり常用漢字は法で強制される漢字のすべてではなく、公文書や新聞といった一般の生活ではこの程度で通じる、と定めた基準線なのです。
仮名はそれぞれ46字の基本文字で日本語の音節を書くと広く紹介され、ひらがなは助詞や語尾のような文法要素に、カタカナは外来語の表記などに主に使われます。一つの言語が表語文字と音節文字を役割分担してともに使うこの仕組みは、文字の類型が言語ごとに一つずつ割り当てられるのではなく、必要に応じて組み合わせられることを示しています。
6. ハングル:発音器官を模した文字
ハングルはアルファベットのように子音と母音を一つずつの文字で書きますが、文字を作った原理と記録が残っているという点で、世界の文字史のなかで特別な位置にあります。国史編纂委員会のウリ歴史ネットは、世宗が1443年(世宗25年)に28の文字を作り、1446年9月に『訓民正音』、通称「解例本」を刊行したと記しています。国立ハングル博物館の常設展示「訓民正音、千年の文字計画」は、その28字が子音17字と母音11字から成り、基本の子音は発音器官の形を模し、母音は天・地・人の原理から導き出されたと説明しています。ユネスコはこの解例本を1997年に世界記憶遺産に登録し、1446年陰暦9月に刊行されたこの書物が、世宗が1443年に完成させた文字を公布した文書であり、集賢殿の学者たちの解説と例示を収めていると紹介しています。原本は澗松美術館が所蔵しています。
今日使われているハングルは28字ではありません。『韓国民族文化大百科事典』の「字母」の項目によれば、韓国語の語文規範は現在、ハングルの基本の字母を子音14字、母音10字、合わせて24字と定めています。15世紀の後舌低母音を書き表したアレア(ㆍ)、声門破裂音のヨリンヒウッ(ㆆ)、軟口蓋鼻音のイエイウン(ㆁ)、歯茎摩擦音のパンチウム(ㅿ)は、音が消えたり、ほかの文字に合わさったりして使われなくなりました。文字は作られたあとも、その言語の音の変化に従って変わります。ハングルの24字は、その変化の結果です。
7. 文字と言語は別のもの
本稿の事例が繰り返し示している事実が一つあります。文字と言語は別のものだということです。アラビア文字はアラビア語だけでなくペルシア語やウルドゥー語も書き、エチオピア文字はゲエズ語が礼拝の言語へと退いたあともアムハラ語やオロモ語を書いています。逆に、一つの言語が複数の文字を使う日本語の例もあります。ですから「どこの国の文字」という言い方は、常に慎重に使わなければなりません。文字は言語の音を入れる器であり、器は借りて使い、直して使い、新しく作ることもできるのです。
そして、その器は今も作られています。1949年のンコ、1830年代のヴァイ、20世紀初めのバムン、そして2025年にユニコードへ新しく登録されたベリア・エルペとトロン・シキは、いずれも共同体が自分たちの言語を書くために近現代に作った文字です。文字を「古いものほど正統」と見るまなざしは、この生きた歴史とは合いません。ハングルが1443年という制作年と制作の原理を記録として持っているように、新しい文字もそれぞれの理由と設計を持って生まれ、標準に登録されていきます。
8. 見慣れない文字に出会ったときに覚えておきたい三つのこと
第一に、文字の数で難易度や優劣を判断しないことです。アラビア文字は28字ですが、母音の省略や続け書きの規則を身につける必要があり、デーヴァナーガリーは符号の結合規則が核心で、漢字には常用2,136字という基準線があります。それぞれの文字は、自分の言語に合わせて複雑さを別の場所に配置しただけなのです。
第二に、文字の名前と言語の名前を区別することです。「アラビア文字で書いたウルドゥー語」「エチオピア文字で書いたアムハラ語」のように言えば、誤解が減ります。デジタルテキストのエンコーディングやフォントが、言語ではなく文字体系の単位で区別して処理されるのも、同じ理由です。
第三に、標準を確認することです。ある文字がユニコードに登録されているか、どの文字体系に属するかは、ユニコードコンソーシアムの公開資料で確認でき、各国の文字の規範(韓国の語文規範、日本の常用漢字表)は、それぞれの政府機関が公開しています。音を書き表す方式は四つほどですが、その方式を選んで使ってきた人々の歴史は、172の文字体系の一つ一つに異なる形で刻まれています。