保存時と読み込み時の方式が違う
UTF-8のバイト列をShift_JISとして読むなど、異なる対応表を使うと別の文字へ誤変換されます。これが典型的な文字化けです。
よくある原因
- ファイルの文字コードを自動判定できなかった
- HTTPヘッダーとHTMLの指定が違う
- 変換できない文字が疑問符などへ置き換わった
- 同じデータを何度も誤変換した
安全な確認手順
元ファイルを複製し、推測される文字コードを切り替えて開きます。文字化けした状態で上書きしないことが重要です。
GUIDE 14
文字化けが起きる代表的な原因と、元データを壊さず確認する手順。
UTF-8のバイト列をShift_JISとして読むなど、異なる対応表を使うと別の文字へ誤変換されます。これが典型的な文字化けです。
元ファイルを複製し、推測される文字コードを切り替えて開きます。文字化けした状態で上書きしないことが重要です。