人は、本当の問題がエンコーディングまたはフォントであるときに、ファイルが「変換が必要」だと言うことが多いです。毎日中国語を読まなければ、症状は似て見えます。直しは似ていません。壊れたファイルにOpenCCを走らせても、著者の字は回復しません。無意味を異なる無意味に対応づけます。
何かをアップロードする前に、下の症状をたどってください。
四角(豆腐)
中空の四角または豆腐の正方形は、通常、字が符号点として存在するが、現在のフォントにグリフがないことを意味します。データはすでに正しいことがあります。CJK対応のあるフォントに変えてください。中国語フォントとUnicodeをご覧ください。
すべての中国語の字が四角なら、フォントが最初の容疑者です。一部の字だけが四角なら、珍しい字形の混在、フォントサブセット、またはフォントが決して含まなかった地域グリフであることがあります。
まだ変換しないでください。四角がすでに欲しかった繁体字を隠しているなら、変換は誤ったてこです。
疑問符
字を置き換えた?は、しばしばテキストがそれを保存できない文字セットに通されたことを意味します。UTF-8の中国語の文をLatin-1として保存する、または古いSMSゲートウェイ経由で貼るのが、典型的な道です。元の字はすでに消えていることがあります。変換は再構成できません。
元のメールまたは元の.docxがなおあるなら、そこに戻ってください。疑問符つきのコピーは死体です。
文字化け
中国の代わりの涓浗のような文字列は、誤ったエンコーディングとして読まれたUTF-8バイト、またはその逆です。ページは、中国語の読者がすぐ拒む珍しい、または無意味な字で満ちています。
出発点がなおあるなら、UTF-8でファイルを開き直してください。Wordでは、プレーンテキストファイルを開くときのエンコーディングダイアログを試してください。ブラウザでは、古いサイトを見ているならエンコーディングメニューを試してください。
壊れたコピーだけが存在するなら、自動修復は当たり外れです。一部のツールはUTF-8対GBK対Big5を推測します。推測は物事を悪化させ得ます。コピーで作業してください。
文字化けはよくある変換の問題に載っています。人が誤ってそれを変換し、それから二つの問題を持つからです。
「ほぼ中国語」に見える混在した文字
日本語の文は関連して見え得ます。安全なOpenCC入力ではありません。ファイルが二言語なら、中国語の部分を取り出してください。韓国のハンジャも同じ警告です。
写真のPDFは、エンコーディングの意味では文字化けではありません。テキストではありません。PDFガイドをご覧ください。
変換が正しい次の一歩であるとき
中国語が読め、簡体字形または繁体字形だけが欲しいなら、文書コンバーターまたはテキストコンバーターを使ってください。読めないなら、先にエンコーディングまたはフォントを直してください。
短いテスト:一文をテキストコンバーターにコピーしてください。入力箱がすでにごみを示すなら、止まってください。入力が読め、出力が他方の標準なら、ファイルは問題なく、残りを変換できます。
診断の順
- 本物の中国語の文をハイライトしてコピーできますか?できないなら、スキャン、輪郭、またはテキストが見えないほど壊れたフォントです。
- フォントを変えると文が現れますか?はいなら、変換の仕事ではなく四角でした。
- コピーが無作為な珍しい字のように見えますか?はいなら、文字化けです。
- 語の途中に疑問符がありますか?はいなら、データはすでに失われていました。
- それからだけOpenCCタイプを選び、変換する。
よくある質問
同僚は中国語を見、私は四角を見ます。どちらが正しいですか? 両方です。ファイルは正しく、あなたのフォント対応が誤っていることがあります。再び変換するよう頼む前に、CJKフォントをインストールしてください。
このサイトは文字化けを修復できますか? できません。読める中国語の標準を変換します。
ウェブページはよく見え、ダウンロードしたファイルが誤って見えたのはなぜですか? ブラウザがエンコーディングを推測しました。保存したファイルが誤った推測を凍結しました。
Big5は繁体字と同じですか? Big5は、多くの繁体字テキストに使われた古いエンコーディングです。Unicodeの繁体字が現代の保存です。UTF-8として誤って開かれたBig5ファイルは文字化けになります。
疑問符を「直す」ためにファイルを変換すべきですか? いいえ。出発点を回復してください。