Dokumentleitfäden

Chinesische Schriftarten, Unicode, vereinfachtes und traditionelles Chinesisch erklärt

Google Ad Placeholder

Unicode weist jedem Zeichen eine Zahl zu. 国 und 國 sind unterschiedliche Codepunkte. Eine Schriftart ist eine Zeichnung dieser Codepunkte. Wenn die Datei das richtige Zeichen hat, die Schriftart aber keine Glyphe, sehen Sie ein Kästchen. Wenn die Datei die falschen Bytes hat, sehen Sie Zeichensalat.

Deshalb sind Konvertierung und Schriftarten verwandt, aber nicht dieselbe Aufgabe. OpenCC kann 国 in 國 ändern. Es kann 微软雅黑, Songti TC oder Noto Serif CJK nicht auf dem Computer einer anderen Person installieren. Menschen senden eine konvertierte Datei, die Kollegin oder der Kollege sieht Tofu-Quadrate, und beide Seiten beschuldigen den Konverter. Die Quadrate sind meist ein Schriftartenabdeckungsproblem.

Codepunkte sind keine Bilder

Eine Word-Datei speichert Zeichen als Zahlen. Die Schriftartdatei speichert Zeichnungen, die an diese Zahlen gekoppelt sind. Wenn die Zeichnung fehlt, kann das Betriebssystem:

  • ein Kästchen zeigen
  • für dieses eine Zeichen auf eine andere Schriftart zurückfallen
  • eine Glyphe einer anderen Region für einen Codepunkt zeigen, der lokalisierte Varianten hat

Rückfall kann einen Satz wie eine Lösegeldforderung aussehen lassen: ein Zeichen in Song, das nächste in einer serifenlosen Systemschrift. Das ist hässlich und trotzdem lesbar. Ein hartes Kästchen ist schlimmer, weil Sie nicht sagen können, ob die Konvertierung geschehen ist.

Manche Codepunkte haben regionsspezifische Glyphenvarianten. Die Zahl ist dieselbe; die bevorzugte Zeichnung unterscheidet sich für taiwanische, hongkonger oder festländische Quellen. Eine für eine Region entworfene Schriftart kann 骨 oder 起 leicht anders zeichnen. Leserinnen und Leser bemerken das. Das ist nicht OpenCC, das das falsche Zeichen ändert. Es sind die Locale-Tabellen der Schriftart. Siehe traditionelles Chinesisch in Taiwan und Hongkong für Unterschiede auf Zeichenebene, die unterschiedliche Codepunkte sind.

Ein Schriftsystem, viele Schriftarten

  • Auf Vereinfacht ausgerichtete Schriftarten können ungewöhnliche traditionelle Formen fehlen.
  • Auf Traditionell ausgerichtete Schriftarten können manche vereinfachten Formen fehlen.
  • Eine große CJK-Schriftart oder ein Paar SC/TC-Schriftarten ist die übliche Lösung.

Betriebssysteme liefern bereits Rückfallschriftarten wie Microsoft YaHei, PingFang, Source Han / Noto CJK und Songti. Diese Website verwendet diese Systemschriftarten in CSS statt Schriftartdateien zu bündeln. Ihr Dokument sollte etwas Ähnliches tun: eine Schriftfamilie wählen, die die Zielnorm tatsächlich enthält.

Wenn Sie Schriftarten in PowerPoint oder PDF einbetten, betten Sie vielleicht nur die Glyphen ein, die Sie verwendet haben. Nach der Konvertierung werden neue Glyphen gebraucht. Eine Datei, die in Vereinfacht „in sich geschlossen“ war, kann in Traditionell aufhören, in sich geschlossen zu sein. Betten Sie eine volle CJK-Schriftart neu ein oder sagen Sie Empfängerinnen und Empfängern, welche Schriftart sie installieren sollen.

Dokumente nach der Konvertierung

Wenn Sie eine Word-, Excel- oder PowerPoint-Datei konvertieren, ändern sich die Zeichen in der Datei. Empfängerinnen und Empfänger brauchen trotzdem eine Schriftart, die sie zeichnen kann. Wenn eine Kollegin oder ein Kollege Ihre Datei öffnet und Kästchen sieht, schicken Sie ihnen diese Seite und die Checkliste zu unleserlichem Chinesisch, bevor Sie erneut konvertieren.

Ein praktisches Prüfgerät hat:

  • eine vereinfacht-fähige Schriftart
  • eine traditionell-fähige Schriftart
  • dieselbe Office-Version, die Sie zum Vorführen nutzen werden

Wenn Sie nur auf dem Laptop prüfen, der das vereinfachte Original erzeugt hat, sehen Sie vielleicht die traditionellen Rückfallfehler nicht, die Ihre Kundin oder Ihr Kunde sehen wird.

Unicode ist der Grund, warum Konverter existieren können

Weil 门 und 門 unterschiedliche Zahlen sind, kann ein Wörterbuch das eine durch das andere ersetzen, ohne sich darum zu kümmern, wie ein Pinsel sie schreiben würde. Vereinfachtes vs. traditionelles Chinesisch ist eine soziale Norm. Unicode ist die technische. OpenCC sitzt dazwischen.

Ältere Kodierungen — Big5, GB2312, GBK — speicherten Chinesisch in kleineren Karten. Dateien aus den 1990ern erscheinen noch in Anhängen. Wenn diese Bytes als UTF-8 gelesen werden, erhalten Sie Müll, keine Kästchen. Müll ist Kodierung. Kästchen sind Schriftarten. Lassen Sie OpenCC nicht über Müll laufen.

Häufig gestellte Fragen

Gibt es eine Schriftart, die alles Chinesische abdeckt? Große CJK-Familien wie Noto CJK / Source Han decken sehr viel ab. „Ganz Unicode“ ist trotzdem viel. Für Büroarbeit reichen eine aktuelle SC-Schriftart plus eine aktuelle TC-Schriftart.

Sollte ich in Bilder konvertieren, damit Schriftarten keine Rolle spielen? Das vereitelt Bearbeitung, Suche und spätere Konvertierung. Beheben Sie stattdessen Schriftarten.

Warum sieht mein Browser in Ordnung aus und Word falsch? Browser und Word teilen nicht dieselbe Rückfallliste. Testen Sie in der Anwendung, die die Empfängerin oder der Empfänger nutzen wird.

Betten die Downloads dieser Website chinesische Schriftarten ein? Die konvertierten Bürodateien behalten die Schriftarteninformationen, die sie bereits hatten, plus die neuen Zeichen. Sie installieren keine Schriftart auf Ihrem Computer.

Sind 国 und 國 in Unicode dasselbe Zeichen? Nein. Sie sind ein vereinfacht/traditionell-Paar mit unterschiedlichen Codepunkten. Das macht Konvertierung zu einer echten Operation.

Google Ad Placeholder