文字コード | 応用情報技術者試験
文字コードとは
文字コード(もじこーど)とは、コンピュータで文字を扱うために、1つひとつの文字に対して割り当てられた固有の「識別番号」のルールのことです。コンピュータは「0」と「1」の数値しか理解できないため、文字を画面に表示したり保存したりするには、すべての文字を数値に置き換える必要があります。この置き換えルールのことを文字コードと呼びます。代表的な規格には、英語圏の基本である「ASCII」、世界中の文字を1つの規格で表せる「Unicode」およびその表現形式である「UTF-8」、日本国内でかつて広く使われていた「Shift_JIS」などがあります。送る側と受け取る側で異なる文字コードを使うと、数字から文字への翻訳がうまくいかず、「文字化け」という現象が発生してしまいます。
具体例
アルファベットの「A」や日本語の「あ」に割り当てられている文字コード(UTF-8)の例です。
・文字「A」 = 16進数コード「41」 (2進数: 01000001)
・文字「B」 = 16進数コード「42」 (2進数: 01000010)
・文字「あ」= 16進数コード「E3 81 82」
【文字化けの例】
送信側が「あ」をShift_JIS(82 A0)で送信したのに対し、
受信側がUTF-8のルールで解釈しようとすると、対応する文字がズレて「縺」などの無関係な文字になってしまいます。