Volver al blog

Contentful · 13 may 2026

El texto enriquecido es la verdadera prueba del flujo de trabajo de traducción

El texto sin formato es fácil. Un flujo de trabajo de localización demuestra su valor cuando puede preservar enlaces, listas, incrustaciones y estructura dentro del texto enriquecido de Contentful.

El texto enriquecido es la verdadera prueba del flujo de trabajo de traducción

Un titular y una breve descripción pueden hacer que casi cualquier flujo de trabajo de traducción parezca competente. La verdadera prueba comienza cuando la entrada de origen contiene listas anidadas, enlaces en línea, entradas incrustadas y formato que transmite significado.

Ahí es donde la traducción deja de ser un problema de texto y se convierte en un problema de estructura de contenido.

El texto enriquecido es un documento, no una cadena

El texto enriquecido de Contentful se almacena como un árbol. Los párrafos contienen nodos de texto. Las listas contienen elementos de lista. Los enlaces y las entradas incrustadas apuntan a otro contenido. Las marcas contienen negrita, cursiva, código y otro formato.

Si se aplana ese árbol en texto sin formato, las palabras pueden sobrevivir, pero la entrada no.

Un flujo de trabajo confiable tiene que traducir el idioma mientras preserva el documento:

  • los encabezados siguen siendo encabezados
  • los elementos de la lista permanecen en el orden correcto
  • los enlaces conservan sus destinos
  • las entradas en línea permanecen en la oración donde los editores las colocaron
  • los bloques incrustados conservan su relación con el texto circundante

Nunca se debería pedir al modelo de traducción que reconstruya una estructura que el flujo de trabajo podría haber protegido explícitamente.

Los fallos peligrosos parecen plausibles

El daño en el texto enriquecido no siempre es obvio en una revisión de traducción. Una incrustación faltante puede dejar un párrafo que aún se lee con naturalidad. Una lista dividida puede parecer varios párrafos válidos. Una entrada en línea puede desaparecer mientras la oración se cierra alrededor del vacío.

Eso hace que los errores estructurales sean más peligrosos que una excepción visible. La solicitud puede marcarse como exitosa aunque la entrada localizada ya no represente la fuente.

Las buenas herramientas de revisión hacen visible la estructura protegida. Los editores deberían poder ver dónde se encuentran las incrustaciones, los enlaces y el formato sin leer JSON sin procesar ni confiar en que cada token haya sobrevivido.

Proteger primero, traducir después

Una canalización sólida de texto enriquecido separa el contenido traducible del contenido estructural.

Antes de que un modelo reciba el documento, el flujo de trabajo puede reemplazar los nodos protegidos por marcadores de posición estables. El modelo traduce el lenguaje circundante. Luego, el flujo de trabajo restaura los nodos originales y valida que cada marcador de posición haya regresado exactamente una vez.

Esto crea responsabilidades claras:

  • el modelo se encarga del lenguaje
  • la aplicación se encarga de la estructura
  • la validación detecta contenido protegido faltante o duplicado

Ese límite es mucho más confiable que pedir a una sola respuesta probabilística que preserve por convención un documento completo de CMS.

Revisar la jerarquía, no solo la prosa

La revisión humana debería comparar más que oraciones. También debería responder:

  1. ¿Están representadas todas las secciones de origen?
  2. ¿Se mantuvo intacta la anidación de las listas?
  3. ¿Siguen los enlaces y las entradas incrustadas unidos al contexto correcto?
  4. ¿Los bloques vacíos de origen permanecieron fuera del resultado traducido?
  5. ¿La vista previa renderizada coincide con la jerarquía de contenido de la página de origen?

La pregunta final importa porque un documento estructuralmente válido aún puede producir una página extraña. La vista previa revela si un encabezado traducido se parte mal, un CTA rompe el diseño o una incrustación aterriza en una posición visual inesperada.

La conclusión

El texto enriquecido es donde un flujo de trabajo de traducción se gana la confianza. Preservar las palabras es solo el primer requisito. El sistema también tiene que preservar el documento que los editores construyeron alrededor de esas palabras.

Trata la estructura como datos protegidos, válidala antes de guardar y revisa el resultado en la vista previa del CMS. Cuando el texto enriquecido sobrevive a todo ese recorrido, los campos más simples se convierten en el caso fácil que deberían ser.