コンピュータ黎明期には、アルファベットや数字、一部の記号だけを表す7ビットの「ASCII(アスキー)コード」が標準でした。その後、日本語のひらがなや漢字など多数の文字を扱うために、日本では「Shift_JIS」や「EUC-JP」といった独自の2バイト(16ビット)文字コードが普及しました。しかし、各言語圏が独自のコードを使っていたため、国際的なデータのやり取りで文字化けが頻発しました。そこで登場したのが、世界中のあらゆる文字を1つの巨大なコード表にまとめた「Unicode(ユニコード)」です。現在、インターネット上のWebサイトや多くのプログラミング言語では、このUnicodeを効率よくデータとして表現するための符号化方式である「UTF-8(文字によって1バイトから4バイトまで長さが変わる可変長方式)」が世界的な標準規格として使われており、文字化けのトラブルは過去に比べて劇的に減少しました。
試験でのポイント