文字化けの原因を診断する
貼り付けられた文字化けパターンを解析し、原因の誤読ペアを診断します。
復元可能な場合はテキストを復元し、不可逆な場合は元のファイルでの正しい直し方を案内します。
画面からコピーした文字は、化けた時点で情報が失われている場合があります。元のファイルが手元にあるなら、ファイルの文字コード変換 の方が確実です。
文字化けパターン早見表と復元可否
| 化け方の特徴(例) | 誤読の組み合わせ | 復元可否 | 対処法 |
|---|---|---|---|
| テスト (カタカナ) ※ ã‚ã„ (ひらがな) 等 | UTF-8 を Latin-1 / Windows-1252 で開いた | 条件付き可逆 | カタカナ(テスト)等は画面コピペでも100%復元可能。ひらがな(ã‚ã„)はコピペ時に未定義バイト(0x81等)が落とされ「?」になります。ファイル変換なら全文字100%復元できます。 |
| 縺縺„縺 / 繧ォ繧BF | UTF-8 を Shift_JIS で開いた | 部分的に可逆 | 一部の不正バイトが欠落する場合があります。元ファイルがあればファイル変換が確実です。 |
| ・、サハオケ / アウソチ | EUC-JP を Shift_JIS で開いた | 部分的に可逆 | 文字の一部が半角カナ等に化けています。元ファイルから Shift_JIS へ変換を推奨。 |
| �(が大量発生) | Shift_JIS/EUC-JP を UTF-8 で無理に開いた | 不可逆 | 「�」に潰れたバイトはテキストから復元できません。必ず元ファイルから変換を行ってください。 |
使い方
- 化けたテキストを貼り付ける
画面や PDF からコピーした文字化けテキストを、そのまま入力欄に貼り付けます。
- 診断結果を読む
化け方のパターンから、どの文字コードをどの文字コードとして読んでしまったのか(誤読の組み合わせ)を推定します。
- 復元するか、元ファイルへ戻る
復元できるパターンなら復元後のテキストが表示されます。復元できないパターンのときは、元のファイルから変換し直す手順をご案内します。
FAQ
Q. なぜ復元できない文字化けがあるのですか?
A. 化けた時点で情報が失われている場合があるためです。特に「」(U+FFFD)に置き換わった文字は、元が何バイトのどの文字だったかという情報ごと消えています。この状態のテキストからは、どんなツールを使っても復元できません。
Q. 復元したテキストが一部だけおかしいのですが。
A. 画面からコピーした時点で、一部のバイトが欠落していることがあります。カタカナは復元しやすく、ひらがなは欠落が起きやすいという傾向があります。元のファイルが手元にあるなら、テキストの復元よりファイルの文字コード変換のほうが確実です。
Q. 診断結果の「誤読の組み合わせ」とは何ですか?
A. 「UTF-8 で保存されたファイルを Shift_JIS として読んだ」のように、保存時と読み込み時の文字コードの食い違いのことです。この組み合わせが分かると、元のファイルをどう変換し直せばよいかが決まります。
Q. 貼り付けたテキストは保存されますか?
A. 保存されません。診断も復元もブラウザ内で完結し、入力した内容がサーバーへ送られることはありません。