1.08.3標準
電子メールなどで使われてきたISO-2022-JPの文字集合切替方法を確認する。
適切な説明はどれか。
× 不正解
ISO-2022-JPはescape sequenceでASCIIや日本語文字集合の状態を切り替える7ビット系の符号化である。
詳細解説
誤り各Unicode符号位置を1~4バイトへ直接符号化する
UTF-8の方式である。
1~4バイトでUnicode符号位置を直接表すのはUTF-8で、ISO-2022-JPの集合切替方式とは異なる。
正しいescape sequenceでASCIIや日本語の文字集合を切り替える
ISO-2022-JPは状態を切り替えながら7ビット範囲のバイトを使う。
ESCから始まるsequenceで状態を変え、後続バイトをASCIIや日本語集合として解釈する。
誤り西欧文字を単一の8ビット値だけで表す
ISO-8859-1の性質に近い。
単一の8ビット西欧文字集合という説明はISO-8859-1に対応する。
誤り英数字と制御文字だけを7ビットで表す
ASCIIだけの説明で、日本語集合の切替を含まない。
ASCIIだけでは日本語を扱えず、ISO-2022-JPはASCII状態に加えて日本語集合へ切り替える。
実際に確かめる
一時的な検証環境で実行できる例です。
printf 'Aあ' | iconv -f UTF-8 -t ISO-2022-JP | od -An -tx1期待される結果
41に続き1bから始まる文字集合切替sequenceを含むbyte列理解のポイント
- escape sequence
- stateful encoding
- ASCIIへ戻すsequence
確認時の注意
- 確認環境: UTF-8端末 / ISO-2022-JP対応iconv
基礎のおさらい
状態依存
同じバイト値でも、直前のescape sequenceで選ばれた文字集合によって解釈が変わる。
ASCIIへ戻す
日本語区間の後はASCII状態へ戻すsequenceを含め、後続テキストの解釈を明確にする。
問題IDKL-102-1068
確認環境UTF-8端末 / ISO-2022-JP対応iconv
最終技術確認2026-08-13
誤り・権利侵害を報告