Guías de documentos

Fuentes chinas, Unicode, chino simplificado y tradicional explicados

Google Ad Placeholder

Unicode asigna un número a cada carácter. 国 y 國 son puntos de código distintos. Una fuente es un dibujo de esos puntos de código. Si el archivo tiene el carácter correcto pero la fuente no tiene glifo, ve un recuadro. Si el archivo tiene los bytes equivocados, ve texto ilegible.

Por eso la conversión y las fuentes están relacionadas pero no son el mismo trabajo. OpenCC puede cambiar 国 por 國. No puede instalar 微软雅黑, Songti TC o Noto Serif CJK en el ordenador de otra persona. La gente envía un archivo convertido, el colega ve tofu cuadrado y ambos lados culpan al convertidor. Los cuadrados suelen ser un problema de cobertura de fuente.

Los puntos de código no son dibujos

Un archivo Word almacena caracteres como números. El archivo de fuente almacena dibujos indexados a esos números. Cuando falta el dibujo, el sistema operativo puede:

  • mostrar un recuadro
  • recurrir a otra fuente para ese carácter
  • mostrar el glifo de otra región para un punto de código que tiene variantes localizadas

La reserva puede hacer que una frase se vea como una nota de rescate: un carácter en Song, el siguiente en una fuente de sistema sans-serif. Eso es feo y aún legible. Un recuadro duro es peor, porque no puede decir si ocurrió la conversión.

Algunos puntos de código tienen variantes de glifo específicas de la región. El número es el mismo; el dibujo preferido difiere para orígenes de Taiwán, Hong Kong o China continental. Una fuente diseñada para una región puede dibujar 骨 o 起 de forma ligeramente distinta. Los lectores lo notan. Esto no es OpenCC cambiando el carácter equivocado. Son las tablas de configuración regional de la fuente. Vea chino tradicional en Taiwán y Hong Kong para las diferencias a nivel de carácter que son puntos de código distintos.

Un sistema de escritura, muchas fuentes

  • Las fuentes centradas en simplificado pueden carecer de formas tradicionales poco comunes.
  • Las fuentes centradas en tradicional pueden carecer de algunas formas simplificadas.
  • Una fuente CJK grande, o un par de fuentes SC/TC, es el arreglo habitual.

Los sistemas operativos ya incluyen fuentes de reserva como Microsoft YaHei, PingFang, Source Han / Noto CJK y Songti. Este sitio usa esas fuentes de sistema en CSS en lugar de empaquetar archivos de fuente. Su documento debe hacer algo similar: elija una familia de fuentes que realmente contenga la norma de destino.

Cuando incrusta fuentes en PowerPoint o PDF, puede incrustar solo los glifos que usó. Después de la conversión, se necesitan glifos nuevos. Un archivo que era «autónomo» en simplificado puede dejar de serlo en tradicional. Vuelva a incrustar una fuente CJK completa, o diga a los destinatarios qué fuente instalar.

Documentos después de la conversión

Cuando convierte un archivo Word, Excel o PowerPoint, los caracteres del archivo cambian. Los destinatarios siguen necesitando una fuente que pueda dibujarlos. Si un colega abre su archivo y ve recuadros, envíele esta página y la lista de chino ilegible antes de volver a convertir.

Una máquina práctica de revisión tiene:

  • una fuente capaz de simplificado
  • una fuente capaz de tradicional
  • la misma versión de Office que usará para presentar

Si solo revisa en el portátil que creó el original simplificado, puede no ver los fallos de reserva tradicional que verá su cliente.

Unicode es la razón de que existan los convertidores

Como 门 y 門 son números distintos, un diccionario puede sustituir uno por el otro sin importarle cómo los escribiría un pincel. Chino simplificado y tradicional es una norma social. Unicode es la técnica. OpenCC se sitúa entre ellas.

Las codificaciones más antiguas — Big5, GB2312, GBK — almacenaban el chino en mapas más pequeños. Los archivos de los años 1990 aún aparecen en adjuntos. Si esos bytes se leen como UTF-8, obtiene basura, no recuadros. La basura es codificación. Los recuadros son fuentes. No ejecute OpenCC sobre basura.

Preguntas frecuentes

¿Hay una fuente que cubra todo el chino? Familias CJK grandes como Noto CJK / Source Han cubren mucho. «Todo Unicode» sigue siendo mucho. Para el trabajo ofimático, una fuente SC actual más una fuente TC actual basta.

¿Debo convertir a imágenes para que las fuentes no importen? Eso derrota la edición, la búsqueda y la conversión posterior. Arregle las fuentes en su lugar.

¿Por qué el navegador se ve bien y Word se ve mal? El navegador y Word no comparten la misma lista de reserva. Pruebe en la aplicación que usará el destinatario.

¿Este sitio incrusta fuentes chinas en las descargas? Los archivos ofimáticos convertidos conservan la información de fuente que ya tenían, más los caracteres nuevos. No instalan una fuente en su ordenador.

¿国 y 國 son el mismo carácter en Unicode? No. Son un par simplificado/tradicional con puntos de código distintos. Eso es lo que hace de la conversión una operación real.

Google Ad Placeholder