そもそも、なぜ現代の進化したオフィス環境においてこのような原始的なトラブルが起きるのでしょうか。ダウンロードしたCSVが文字化けする理由の根底には、長年引き継がれてきた業界の歴史的背景と文字コード規格の断絶が存在します。
コンピュータは文字を直接理解できず、すべての文字を「0と1」の数値(文字コード)に置き換えて処理しています。世界標準として現在Webやクラウドシステム、SaaSツールの主流となっているのが「UTF-8」です。一方で、日本のWindows環境において長年エクセルの標準文字コードとして君臨してきたのが「Shift_JIS(CP932)」でした。
Salesforce、kintone、各種ECプラットフォームなどのWebシステムから出力されるデータは、国際規格である「UTF-8」でエンコードされているケースが大半を占めます。しかし、日本のWindows版エクセルは、CSVファイルをダブルクリックで開く際、デフォルトで「Shift_JIS」として中身を解読しようとします。その結果、エクセル側が「UTF-8の文字データを無理やりShift_JISの規則で翻訳」してしまい、意味不明な記号の羅列へと変貌を遂げるわけです。
これがエクセル文字化けの原因と理由の核心です。つまり、データそのものが消えたわけでも、送信元のファイルが破損しているわけでもなく、受け手側の解釈ルールが食い違っているだけの「翻訳ミス」に過ぎません。