Conversión china

Problemas habituales al convertir chino simplificado y tradicional

Google Ad Placeholder

La conversión automática es rápida. También es literal. El motor sustituye caracteres (y a veces palabras) a partir de diccionarios. No conoce a su cliente, su genealogía ni sus normas de marca. Estos son los problemas que la gente encuentra con más frecuencia después de pulsar Convertir.

Ninguno de ellos significa «no use nunca un convertidor». Significan: conozca los modos de fallo y luego revise los lugares donde esos modos se concentran.

Una forma simplificada, varias formas tradicionales

后, 发, 面 y 干 son ejemplos famosos. En chino simplificado una forma cubre sentidos que el chino tradicional sigue separando. El convertidor elige a partir de diccionarios y de una ventana de contexto corta. Aun así puede elegir el carácter tradicional equivocado en un nombre, una cita clásica o una celda de tabla de una sola palabra.

Este es el error lingüístico más importante, porque la salida se ve fluida. Un lector puede no notar que un nombre personal se ha reescrito como un adverbio común. Vea un carácter simplificado, varias formas tradicionales para ejemplos y una lista de búsqueda.

La otra dirección, de tradicional a simplificado, oculta la división en lugar de inventarla. Eso se siente más limpio y es más fácil de pasar por alto como problema. El coste aparece más tarde, cuando alguien convierte el archivo simplificado de vuelta y no puede recuperar las distinciones tradicionales originales.

El archivo ya estaba roto

Si el origen es texto ilegible — sopa de æ, ensalada de å o recuadros en lugar de caracteres —, la conversión multiplica el desorden. OpenCC mapeará con gusto basura a otra basura si los bytes casualmente se parecen a caracteres.

Abra primero el origen en Word o en un editor de texto. Si no puede copiar una frase china legible, deténgase. Arregle el texto ilegible y confirme una fuente Unicode real antes de convertir.

Una trampa relacionada es un PDF que solo parece texto. Si no puede resaltar una frase, la página es una imagen. La conversión extraerá poco o nada útil. Eso es un trabajo de OCR, no un trabajo de OpenCC.

Japonés o coreano mezclado

El kanji y el hanja se ven relacionados con los caracteres chinos. No son una entrada OpenCC intercambiable. Las simplificaciones shinjitai japonesas siguieron una historia distinta de la del chino simplificado de China continental. Un párrafo japonés pasado por un convertidor chino puede dañar partículas, kanji junto a kana y palabras que solo existen en japonés.

Si un documento mezcla chino y japonés — un programa de conferencia, un manual bilingüe, una lista de nombres —, convierta solo las porciones chinas o divida el archivo. La misma precaución se aplica al texto coreano que incluye hanja. Los tipos de conversión OpenCC son normas chinas, no un reescritor CJK general.

Palabras regionales y el destino equivocado

Una tabla de frases de Taiwán no hará que los lectores de Hong Kong se sientan en casa, y lo contrario también es cierto. La salida puede ser legible y aun así «rara», como un lector británico nota el truck y el apartment estadounidenses.

Esto no siempre es un error. Es un tipo de conversión equivocado. Elija Taiwán o Hong Kong a propósito. Si solo necesitaba caracteres y el vocabulario se volvió sorprendentemente local, puede haber elegido un tipo de frases por accidente.

Nombres, marcas y cadenas protegidas

Los convertidores no conocen su lista de no traducir. Un nombre de empresa, un nombre de medicamento, un nombre de templo o una marca romanizada que casualmente contiene caracteres chinos puede cambiar. También puede hacerlo el nombre de pila de una persona que usa un carácter raro.

Antes de un trabajo grande, reúna las cadenas que deben quedarse. Después de la conversión, búsquelas. Si una cadena debe permanecer simplificada dentro de un documento tradicional, o al revés, déjela fuera de la pasada automática y péguela de vuelta.

Maquetación, ajuste de línea y fuentes

Los caracteres tradicionales suelen ser más anchos. Un título de diapositiva, un botón o una columna de hoja de cálculo que apenas cabían con etiquetas simplificadas pueden desbordarse, ajustar línea o chocar con un logotipo. Eso es una comprobación de maquetación, no siempre un error de conversión.

Las fuentes causan una segunda falsa alarma visual. Si la fuente de salida carece de glifos tradicionales, verá recuadros o formas de reserva aunque los puntos de código sean correctos. Instale o incruste una fuente que cubra la norma de destino. Los detalles están en fuentes chinas y Unicode.

Excel tiene su propia variante: las fórmulas deben seguir siendo fórmulas. Si una etiqueta dentro de una fórmula era china, puede convertirse. Los valores de celda que parecen números no deberían. Si una hoja se ve vacía después de la conversión, mire las fuentes y si el texto de origen se almacenó como texto en absoluto.

Partes ocultas del archivo

Word almacena texto en encabezados, pies, comentarios, notas a pie de página, recuadros de texto y tablas. PowerPoint lo almacena en notas y patrones. Excel lo almacena en comentarios, nombres de hoja y nombres definidos. Un convertidor que solo tocara el cuerpo dejaría un desorden bilingüe.

ChineseDocConverter está pensado para leer esas partes de los formatos ofimáticos que admite. Aun así debe abrir la descarga y recorrer encabezados, notas y pestañas de hoja. El texto oculto es donde se esconden los caracteres simplificados o tradicionales que quedan.

Un orden de reparación que ahorra tiempo

  1. Confirme que el origen es chino legible, no texto ilegible ni un escaneo.
  2. Confirme que eligió el tipo regional correcto.
  3. Convierta una muestra y luego el archivo completo.
  4. Busque caracteres de fusión y nombres protegidos.
  5. Compruebe la maquetación y las fuentes.
  6. Solo entonces envíe el archivo.

Si convierte, nota un problema y vuelve a convertir desde el archivo ya convertido, dificulta el diagnóstico. Vuelva al original.

Preguntas frecuentes

La salida se ve fluida. ¿Puedo saltarme la revisión? Fluido es exactamente cómo se ve un 後 equivocado en un nombre. Repase al menos nombres y títulos.

¿Por qué solo cambió parte de mi PDF? El resto probablemente son contornos, imágenes o un subconjunto de fuente que no se extrajo como texto.

¿Puedo deshacer una conversión mala? Solo si conservó el archivo original. No confíe en convertir de vuelta.

¿Un documento más largo falla con más frecuencia? Falla en más sitios, no a un ritmo más alto por frase. Las páginas de muestra siguen prediciendo la mayoría de los problemas de diccionario. No predicen cada nombre.

Google Ad Placeholder