【問113】ITパスポート 練習問題|文字コードの種類
基礎理論とアルゴリズム 問3/20難易度A(易しい)
問題文
文字コードのうち、UTF-8の説明として最も適切なものはどれか。
- 1.英数字と制御文字だけを7ビットで表す、最も基本的な文字コードである
- 2.日本語を扱うために国内で広く使われてきた文字コードで、半角文字を1バイト、全角文字を2バイトで表す
- 3.画像や音声のデータを圧縮して保存するために定められた標準の形式である
- 4.世界中の文字を集めたUnicodeを、1バイトから4バイトの可変長で符号化する方式である
解説
正解は4。UTF-8は、世界中の文字に共通の番号を割り当てた文字集合であるUnicodeを、1バイトから4バイトまでの可変長で符号化する方式である。英数字はASCIIと同じ1バイトで表せるうえ、多言語を1つの文字コードで扱えるためWebで広く使われている。1は誤り。英数字と制御文字を7ビットで表すのはASCIIの説明である。2は誤り。日本語向けに国内で広く使われてきた文字コードはシフトJISである。3は誤り。画像や音声の圧縮形式は文字を表す符号ではないので文字コードには当たらない。送信側と受信側で使う文字コードが食い違うと文字化けが起こるという点まで結び付けて覚えておくとよい。