Volver al blog

Reliability · 19 ago 2026

Protege marcadores de posición, enlaces e identificadores en la traducción con IA

Una salida fluida no es suficiente cuando un token modificado puede romper la página. Los flujos de trabajo de traducción deben proteger el contenido funcional antes de que comience la generación.

Protege marcadores de posición, enlaces e identificadores en la traducción con IA

Algunas de las partes más importantes de una traducción no deberían traducirse en absoluto.

Las variables, las URL, los ID de entrada, las referencias de recursos, los ejemplos de código y los marcadores de formato cumplen una función más que aportar prosa. Un modelo puede producir una frase que suene natural mientras cambia discretamente uno de esos elementos y rompe la experiencia a su alrededor.

Una traducción fiable con IA comienza separando el lenguaje de la estructura.

Identifica el contenido protegido antes del prompt

No confíes en una instrucción general como "preserve placeholders." Primero identifica los tokens y nodos exactos que deben permanecer intactos.

El contenido protegido suele incluir:

  • variables de interpolación como {first_name} o {{ total }}
  • sintaxis de mensajes ICU y selectores de plural
  • URL, direcciones de correo electrónico y fragmentos de ruta
  • atributos HTML y destinos de enlaces de markdown
  • referencias de entradas y recursos de Contentful
  • fragmentos de código, bloques de código delimitados y valores de API
  • nombres de productos marcados como no traducibles

El modelo de contenido y el tipo de campo deben ayudar a determinar las reglas de protección. Un documento de texto enriquecido necesita un manejo estructural diferente al de un título de texto plano.

Sustituye los valores de riesgo por tokens estables

Para cadenas simples, un enfoque sólido es extraer los valores protegidos y sustituirlos por tokens temporales inequívocos antes de la traducción.

El modelo ve el lenguaje circundante, pero no puede reescribir accidentalmente una URL de destino o un identificador. Después de la generación, el flujo de trabajo restaura los valores originales desde un mapa del lado del servidor.

Los tokens deben ser únicos, difíciles de confundir con lenguaje natural y validados antes de la restauración. Nunca confíes en que el modelo reproduzca el mapa por sí mismo.

Traduce el texto enriquecido como estructura

Aplanar un árbol de texto enriquecido en markdown o HTML puede hacer que se pierdan distinciones importantes.

Los nodos de texto son traducibles. Los enlaces, las entradas incrustadas, los tipos de nodo y las marcas son estructurales. Recorre el árbol del documento, traduce las hojas de texto aptas y reconstruye la jerarquía original con las referencias intactas.

Esto también mejora la revisión. Los editores pueden comparar la misma estructura en ambos idiomas en lugar de revisar una aproximación serializada que puede ocultar nodos faltantes o reordenados.

Valida la salida antes de guardarla

La protección necesita un ciclo cerrado.

Después de la traducción, verifica que cada token esperado aparezca exactamente donde el formato lo permita y que no se haya introducido ningún token desconocido. Analiza los formatos estructurados en lugar de comprobarlos con una comparación flexible de cadenas.

Los fallos útiles son específicos:

  • falta el marcador de posición {total}
  • destino del enlace cambiado en el campo ctaBody
  • sintaxis ICU no válida en la configuración regional de
  • recuento inesperado de nodos de texto enriquecido

Rechazar una salida malformada en este límite es más seguro que dejar que el problema aparezca durante el renderizado o, peor aún, después de la publicación.

Muestra los elementos protegidos en la revisión

Los revisores deberían poder reconocer el contenido funcional sin distraerse con él.

Usa un estilo sutil para los marcadores de posición y los términos protegidos. Haz que el texto del enlace sea editable mientras mantienes visible el destino y controlado por separado. Para el contenido incrustado, muestra una etiqueta legible por humanos junto al ID inmutable.

Si un revisor necesita intencionalmente cambiar una URL para un mercado objetivo, trata eso como una decisión distinta de campo localizado en lugar de un efecto secundario accidental de traducir la prosa.

Prueba con ejemplos adversariales

La ruta feliz no es suficiente. Incluye cadenas con variables repetidas, puntuación adyacente, markdown anidado, formas plurales, texto de derecha a izquierda y marcadores de posición que se parezcan a palabras comunes.

La lógica de protección debe demostrar que puede hacer un recorrido de ida y vuelta de esos casos sin pérdidas antes de confiarle contenido de producción.

La conclusión

La calidad de la traducción incluye la integridad funcional.

Extrae el contenido protegido, traduce solo el lenguaje apto, conserva la estructura de texto enriquecido, valida el resultado y deja claros los elementos funcionales durante la revisión. Una frase fluida solo es valiosa cuando la página sigue funcionando después de publicarse.