概要
コンピューターは文字を数字に置き換えて扱うが、その対応の決め方は国や会社ごとにばらばらだった。日本語の文書を別の仕組みのコンピューターで開くと、文字化けして読めなくなった。1980年代の末、ゼロックスやアップルの技術者たちは、世界のすべての文字に一つずつ番号を振る仕組みを考え、「ユニコード」と名づけた。1991年1月にユニコード・コンソーシアムが作られ、10月に最初の版が出た。日本と中国と韓国の漢字を同じ字として一つにまとめたことには、日本で反発も起きた。いまでは十五万を超える文字と、日本で生まれた絵文字が収められ、インターネットの文字のほとんどがユニコードで書かれている。
場所
37.39°N -122.08°E · アメリカ・カリフォルニア州
本文
コンピューターの中では、文字は数字として扱われる。どの数字をどの文字に当てるかを決めたものを、文字コードという。1960年代、アメリカでは英語の文字と記号に番号を振るASCIIが作られたが、そこには128の文字しか入っていなかった。日本語、中国語、アラビア語、ヒンディー語などを扱うため、国ごと、会社ごとに、別々の文字コードが作られた。日本語だけでも、JIS、シフトJIS、EUCなどがあった。違う文字コードで作られた文書を開くと、画面には意味の分からない記号が並んだ。日本語では、これを「文字化け」と呼んだ。
1987年、アメリカのゼロックスの技術者ジョー・ベッカーと、アップルの技術者たちは、世界のすべての文字に一つずつ重ならない番号を振る、一つの文字コードを作る話し合いを始めた。1988年、ベッカーは、この構想を「ユニコード」と名づけた文書を発表した。一つの統一された、普遍的な文字コード、という意味が込められていた。
1991年1月、ユニコード・コンソーシアムがカリフォルニア州で作られ、同じ年の10月、最初の版が出版された。ほぼ同じ時期、国際標準化機構も世界の文字を一つの規格にまとめる作業を進めていて、二つの取り組みは統合され、同じ番号の表を使うことになった。
ユニコードを作るうえで、最も大きな論争になったのは漢字だった。ユニコードは、日本、中国、韓国、台湾で使われる漢字のうち、字の形が少し違っても同じ字とみなせるものを、一つの番号にまとめた。日本では、日本の漢字の独自性が無視され、正しい字形が表示されなくなるとして、強い反発が起きた。一方で、のちには、人名や地名に使う珍しい漢字も次々に加えられていった。
ユニコードは、パソコンのOSとインターネットに採り入れられ、21世紀に入ると世界の標準になった。いまでは、160を超える文字体系の十五万を超える文字が収められ、古代のエジプトの象形文字や楔形文字、消えかけた少数民族の文字も含まれている。2010年には、日本の携帯電話で生まれた絵文字(絵文字)が加えられ、世界中の人々が同じ絵文字でやりとりするようになった。ウェブのページのほとんどは、いまやユニコードで書かれている。