文字の正体を、やさしく。

その文字、何者?

気になる文字を貼り付けるだけ。Unicode・UTF-8・文字種を、1文字ずつ図鑑のように観察できます。

STEP 1

文字を入力

18 文字ブラウザ内で解析
STEP 2

文字を選ぶ

はじめての文字コード

文字化けを、しくみから理解する。

01

文字コードとは

コンピューターは文字をそのまま保存できません。そこで「この番号はこの文字」という対応表を使います。この決まり全体を文字コードと呼びます。

02

Unicodeとは

世界中の文字に共通の番号(コードポイント)を割り当てる規格です。「あ」は U+3042、「😀」は U+1F600 です。

03

UTF-8とは

Unicodeの番号を、ファイルや通信で扱えるバイト列に変換する方式です。ASCIIと互換性があり、Webで広く使われています。

なぜ起きる?

文字化けの主な原因

保存したときの文字コードと、読み込むときに想定した文字コードが違うと、同じバイト列を別の文字として解釈してしまいます。UTF-8のデータをShift_JISとして開く、という食い違いが代表例です。

  • ファイルの保存形式と読み込み設定が違う
  • Webページの文字コード指定が実データと違う
  • 対応していない文字が「?」などへ置き換わる

見えない文字

スペース・改行・タブも文字

画面では見えにくい空白や改行にも固有のコードがあります。本ツールでは半角スペースを「␠」、改行を「↵」、タブを「⇥」として見える形で表示します。余計な空白を探すときにも便利です。

SPACE U+0020TAB U+0009LF U+000A