Chinesische Konvertierung

Häufige Probleme bei der Konvertierung von vereinfachtem und traditionellem Chinesisch

Google Ad Placeholder

Automatische Konvertierung ist schnell. Sie ist auch wörtlich. Die Engine ersetzt Zeichen (und manchmal Wörter) aus Wörterbüchern. Sie kennt weder Ihre Kundin oder Ihren Kunden noch Ihre Genealogie noch Ihre Markenrichtlinien. Das sind die Probleme, auf die Menschen nach dem Drücken von Konvertieren am häufigsten stoßen.

Keines davon bedeutet „nutzen Sie nie einen Konverter“. Sie bedeuten: Kennen Sie die Fehlermodi und lesen Sie dann Korrektur an den Stellen, an denen sich diese Modi sammeln.

Eine vereinfachte Form, mehrere traditionelle Formen

后, 发, 面 und 干 sind berühmte Beispiele. Im vereinfachten Chinesisch deckt eine Form Bedeutungen ab, die das traditionelle Chinesisch noch trennt. Der Konverter wählt aus Wörterbüchern und einem kurzen Kontextfenster. Er kann in einem Namen, einem klassischen Zitat oder einer Ein-Wort-Tabellenzelle trotzdem das falsche traditionelle Zeichen wählen.

Das ist der wichtigste sprachliche Fehler, weil die Ausgabe flüssig wirkt. Eine Leserin oder ein Leser bemerkt vielleicht nicht, dass ein Personenname in ein gewöhnliches Adverb umgeschrieben wurde. Siehe ein vereinfachtes Zeichen, mehrere traditionelle Formen für Beispiele und eine Suchliste.

Die andere Richtung, Traditionell nach Vereinfacht, versteckt die Spaltung, statt sie zu erfinden. Das wirkt sauberer und ist als Problem leichter zu übersehen. Die Kosten erscheinen später, wenn jemand die vereinfachte Datei zurückkonvertiert und die originalen traditionellen Unterscheidungen nicht wiederherstellen kann.

Die Datei war bereits kaputt

Wenn die Quelle Zeichensalat ist — æ-Suppe, å-Salat oder Kästchen statt Zeichen — vervielfacht Konvertierung das Chaos. OpenCC bildet Müll bereitwillig auf anderen Müll ab, wenn die Bytes zufällig wie Zeichen aussehen.

Öffnen Sie die Quelle zuerst in Word oder einem Texteditor. Wenn Sie keinen lesbaren chinesischen Satz kopieren können, halten Sie inne. Beheben Sie unleserlichen Text und bestätigen Sie eine echte Unicode-Schriftart, bevor Sie konvertieren.

Eine verwandte Falle ist ein PDF, das nur wie Text aussieht. Wenn Sie einen Satz nicht markieren können, ist die Seite ein Bild. Die Konvertierung extrahiert wenig oder nichts Nützliches. Das ist eine OCR-Aufgabe, keine OpenCC-Aufgabe.

Gemischtes Japanisch oder Koreanisch

Kanji und Hanja sehen mit chinesischen Zeichen verwandt aus. Sie sind keine OpenCC-Eingabe zum direkten Einwerfen. Japanische Shinjitai-Vereinfachungen folgten einer anderen Geschichte als das festländische vereinfachte Chinesisch. Ein japanischer Absatz, der durch einen chinesischen Konverter läuft, kann Partikel, kana-nahe Kanji und Wörter beschädigen, die nur im Japanischen existieren.

Wenn ein Dokument Chinesisch und Japanisch mischt — ein Konferenzprogramm, eine zweisprachige Anleitung, eine Namensliste — konvertieren Sie nur die chinesischen Teile oder teilen Sie die Datei. Dieselbe Vorsicht gilt für koreanischen Text, der Hanja enthält. OpenCC-Konvertierungstypen sind chinesische Normen, kein allgemeiner CJK-Umschreiber.

Regionale Wörter und das falsche Ziel

Eine taiwanische Phrasentabelle lässt Leserinnen und Leser in Hongkong sich nicht zu Hause fühlen, und das Umgekehrte gilt ebenfalls. Die Ausgabe kann lesbar sein und trotzdem „daneben“, so wie eine britische Leserin oder ein britischer Leser amerikanisches truck und apartment bemerkt.

Das ist nicht immer ein Fehler. Es ist ein falscher Konvertierungstyp. Wählen Sie Taiwan oder Hongkong mit Absicht. Wenn Sie nur Zeichen brauchten und die Formulierung überraschend lokal wurde, haben Sie vielleicht versehentlich einen Phrasentyp gewählt.

Namen, Marken und geschützte Zeichenketten

Konverter kennen Ihre Nicht-übersetzen-Liste nicht. Ein Firmenname, ein Arzneimittelname, ein Tempelname oder eine romanisierte Marke, die zufällig chinesische Zeichen enthält, kann sich ändern. Ebenso der Vorname einer Person, der ein seltenes Zeichen verwendet.

Sammeln Sie vor einem großen Auftrag die Zeichenketten, die stehen bleiben müssen. Suchen Sie nach der Konvertierung danach. Wenn eine Zeichenkette innerhalb eines traditionellen Dokuments vereinfacht bleiben muss oder umgekehrt, lassen Sie sie aus dem automatischen Durchgang heraus und fügen Sie sie wieder ein.

Layout, Umbruch und Schriftarten

Traditionelle Zeichen sind oft breiter. Ein Folientitel, eine Schaltfläche oder eine Tabellenspalte, die gerade noch vereinfachte Beschriftungen fasste, kann überlaufen, umbrechen oder mit einem Logo kollidieren. Das ist eine Layoutprüfung, nicht immer ein Konvertierungsfehler.

Schriftarten verursachen einen zweiten visuellen Fehlalarm. Wenn der Ausgabeschriftart traditionelle Glyphen fehlen, sehen Sie Kästchen oder Rückfallformen, selbst wenn die Codepunkte richtig sind. Installieren oder betten Sie eine Schriftart ein, die die Zielnorm abdeckt. Einzelheiten stehen in chinesische Schriftarten und Unicode.

Excel hat eine eigene Variante: Formeln sollten Formeln bleiben. Wenn eine Beschriftung innerhalb einer Formel Chinesisch war, kann sie konvertiert werden. Zellwerte, die wie Zahlen aussehen, sollten es nicht. Wenn ein Blatt nach der Konvertierung leer wirkt, sehen Sie sich Schriftarten an und ob der Quelltext überhaupt als Text gespeichert war.

Verborgene Teile der Datei

Word speichert Text in Kopf- und Fußzeilen, Kommentaren, Fußnoten, Textfeldern und Tabellen. PowerPoint speichert ihn in Notizen und Mastern. Excel speichert ihn in Kommentaren, Blattnamen und definierten Namen. Ein Konverter, der nur den Hauptteil berührte, hinterließe ein zweisprachiges Durcheinander.

ChineseDocConverter ist so gebaut, dass es diese Teile der unterstützten Office-Formate liest. Sie sollten den Download trotzdem öffnen und durch Kopfzeilen, Notizen und Blattregister klicken. Verborgener Text ist der Ort, an dem übrig gebliebene vereinfachte oder traditionelle Zeichen stecken.

Eine Reparaturreihenfolge, die Zeit spart

  1. Bestätigen Sie, dass die Quelle lesbares Chinesisch ist, kein Zeichensalat und kein Scan.
  2. Bestätigen Sie, dass Sie den richtigen regionalen Typ gewählt haben.
  3. Konvertieren Sie eine Probe, dann die volle Datei.
  4. Durchsuchen Sie Verschmelzungszeichen und geschützte Namen.
  5. Prüfen Sie Layout und Schriftarten.
  6. Erst dann senden Sie die Datei.

Wenn Sie konvertieren, ein Problem bemerken und erneut von der bereits konvertierten Datei konvertieren, erschweren Sie die Diagnose. Gehen Sie zum Original zurück.

Häufig gestellte Fragen

Die Ausgabe wirkt flüssig. Kann ich das Korrekturlesen überspringen? Flüssig ist genau, wie ein falsches 後 in einem Namen aussieht. Überfliegen Sie mindestens Namen und Titel.

Warum hat sich nur ein Teil meines PDFs geändert? Der Rest sind wahrscheinlich Umrisse, Bilder oder eine Schriftartenteilmenge, die nicht als Text extrahiert wurde.

Kann ich eine schlechte Konvertierung rückgängig machen? Nur wenn Sie die Originaldatei aufbewahrt haben. Verlassen Sie sich nicht aufs Zurückkonvertieren.

Scheitert ein längeres Dokument häufiger? Es scheitert an mehr Stellen, nicht mit einer höheren Rate pro Satz. Probeseiten sagen die meisten Wörterbuchprobleme voraus. Sie sagen nicht jeden Namen voraus.

Google Ad Placeholder