全角文字を一言で定義するなら、「活字印刷時代における正方形の活字寸法(em)を基準とした文字」です。原稿用紙のマス目を思い浮かべると分かりやすいでしょう。漢字やひらがな、カタカナのように、縦横が1対1の正方形に収まるように設計された文字が全角文字の基本形にあたります。
一方の半角文字は、もともと欧米のタイプライターやテレタイプ端末で生まれた、横幅が全角の約半分(縦横比1対2の縦長)で作られた文字群を指します。英文字の「A」や数字の「1」など、アルファベット文化圏で使用されていた規格がコンピュータの黎明期にそのまま標準化されました。
日常的に目にする全角文字一覧には、以下のような分類が存在します。
- 日本語固有の文字:漢字、ひらがな、全角カタカナ(「あ」「ア」「漢」など)
- 全角英数:全角アルファベット(「A」「a」)、全角数字(「1」「2」)
- 全角記号・約物:句読点(「、」「。」)、感嘆符・疑問符(「!」「?」)、括弧(「()」「【】」)
- 特殊文字:全角スペース(和字間隔)、全角ハイフン(「ー」「−」)
デジタルデータ黎明期の技術的視点では、両者は「1バイト文字と2バイト文字」として明確に峻別されていました。アルファベットを中心とする半角文字は1バイト(8ビット=256通りの表現)で表現できたのに対し、膨大な文字数を持つ漢字や日本語を処理するためには2バイト(16ビット=約6万5千通りの表現)が必要だったためです。Shift_JISなどの日本語専用エンコーディングから、世界標準であるUnicode(UTF-8)が主流となった現在でも、表示上の文字幅やシステム内部での識別コードは完全に別物として管理されています。