文字化けの原因を診断する

貼り付けられた文字化けパターンを解析し、原因の誤読ペアを診断します。復元可能な場合はテキストを復元し、不可逆な場合は元のファイルでの正しい直し方を案内します。

画面からコピーした文字は、化けた時点で情報が失われている場合があります。元のファイルが手元にあるなら、ファイルの文字コード変換 の方が確実です。

文字化けパターン早見表と復元可否

化け方の特徴(例)誤読の組み合わせ復元可否対処法
テスト (カタカナ)
※ ã‚ã„ (ひらがな) 等
UTF-8 を Latin-1 / Windows-1252 で開いた条件付き可逆カタカナ(テスト)等は画面コピペでも100%復元可能。ひらがな(ã‚ã„)はコピペ時に未定義バイト(0x81等)が落とされ「?」になります。ファイル変換なら全文字100%復元できます。
縺縺„縺 / 繧ォ繧BFUTF-8 を Shift_JIS で開いた部分的に可逆一部の不正バイトが欠落する場合があります。元ファイルがあればファイル変換が確実です。
・、サハオケ / アウソチEUC-JP を Shift_JIS で開いた部分的に可逆文字の一部が半角カナ等に化けています。元ファイルから Shift_JIS へ変換を推奨。
�(が大量発生)Shift_JIS/EUC-JP を UTF-8 で無理に開いた不可逆「�」に潰れたバイトはテキストから復元できません。必ず元ファイルから変換を行ってください。

使い方

  1. 化けたテキストを貼り付ける

    画面や PDF からコピーした文字化けテキストを、そのまま入力欄に貼り付けます。

  2. 診断結果を読む

    化け方のパターンから、どの文字コードをどの文字コードとして読んでしまったのか(誤読の組み合わせ)を推定します。

  3. 復元するか、元ファイルへ戻る

    復元できるパターンなら復元後のテキストが表示されます。復元できないパターンのときは、元のファイルから変換し直す手順をご案内します。

FAQ

Q. なぜ復元できない文字化けがあるのですか?

A. 化けた時点で情報が失われている場合があるためです。特に「」(U+FFFD)に置き換わった文字は、元が何バイトのどの文字だったかという情報ごと消えています。この状態のテキストからは、どんなツールを使っても復元できません。

Q. 復元したテキストが一部だけおかしいのですが。

A. 画面からコピーした時点で、一部のバイトが欠落していることがあります。カタカナは復元しやすく、ひらがなは欠落が起きやすいという傾向があります。元のファイルが手元にあるなら、テキストの復元よりファイルの文字コード変換のほうが確実です。

Q. 診断結果の「誤読の組み合わせ」とは何ですか?

A. 「UTF-8 で保存されたファイルを Shift_JIS として読んだ」のように、保存時と読み込み時の文字コードの食い違いのことです。この組み合わせが分かると、元のファイルをどう変換し直せばよいかが決まります。

Q. 貼り付けたテキストは保存されますか?

A. 保存されません。診断も復元もブラウザ内で完結し、入力した内容がサーバーへ送られることはありません。