Terug naar blog

Reliability · 19 aug 2026

Bescherm placeholders, links en identifiers in AI-vertaling

Vloeiende output is niet genoeg wanneer een gewijzigd token de pagina kan breken. Vertaalworkflows moeten functionele inhoud beschermen voordat de generatie begint.

Bescherm placeholders, links en identifiers in AI-vertaling

Sommige van de belangrijkste onderdelen van een vertaling moeten helemaal niet vertaald worden.

Variabelen, URL's, entry-ID's, assetverwijzingen, codevoorbeelden en opmaakmarkeringen dragen functie in plaats van proza. Een model kan een natuurlijk klinkende zin produceren terwijl het stilletjes een van die elementen wijzigt en de ervaring eromheen verbreekt.

Betrouwbare AI-vertaling begint met het scheiden van taal en structuur.

Identificeer beschermde inhoud vóór de prompt

Vertrouw niet op een algemene instructie zoals "behoud placeholders." Identificeer eerst de exacte tokens en nodes die behouden moeten blijven.

Beschermde inhoud omvat vaak:

  • interpolatievariabelen zoals {first_name} of {{ total }}
  • ICU-berichtsyntaxis en meervoudselectors
  • URL's, e-mailadressen en routefragmenten
  • HTML-attributen en markdown-linkdoelen
  • Contentful entry- en assetverwijzingen
  • code spans, fenced code blocks en API-waarden
  • productnamen die als niet-vertaalbaar zijn gemarkeerd

Het contentmodel en het veldtype moeten helpen bij het bepalen van de beschermingsregels. Een rich-textdocument heeft structurele verwerking nodig die verschilt van een platte-teksttitel.

Vervang risicovolle waarden door stabiele tokens

Voor platte strings is een robuuste aanpak om beschermde waarden te extraheren en ze vóór vertaling te vervangen door ondubbelzinnige tijdelijke tokens.

Het model ziet de omringende taal, maar kan niet per ongeluk een doel-URL of identifier herschrijven. Na generatie herstelt de workflow de oorspronkelijke waarden vanuit een server-side map.

Tokens moeten uniek zijn, moeilijk te verwarren met natuurlijke taal en gevalideerd worden vóór herstel. Vertrouw er nooit op dat het model de map zelf reproduceert.

Vertaal rich text als structuur

Het platmaken van een rich-textboom naar markdown of HTML kan belangrijke verschillen doen verdwijnen.

Tekstnodes zijn vertaalbaar. Links, embedded entries, nodetypen en marks zijn structureel. Doorloop de documentboom, vertaal in aanmerking komende tekstbladeren en bouw de oorspronkelijke hiërarchie opnieuw op terwijl verwijzingen onaangeroerd blijven.

Dit verbetert ook de review. Redacteuren kunnen dezelfde structuur in beide locales vergelijken in plaats van een geserialiseerde benadering te beoordelen die mogelijk ontbrekende of herschikte nodes verbergt.

Valideer de output voordat je die opslaat

Bescherming heeft een gesloten lus nodig.

Controleer na vertaling of elk verwacht token precies verschijnt waar het formaat dat toelaat en dat er geen onbekend token is geïntroduceerd. Parse gestructureerde formaten in plaats van ze te controleren met een losse stringvergelijking.

Nuttige fouten zijn specifiek:

  • ontbrekende placeholder {total}
  • gewijzigd linkdoel in veld ctaBody
  • ongeldige ICU-syntaxis in locale de
  • onverwacht aantal rich-textnodes

Misvormde output op deze grens afwijzen is veiliger dan het probleem te laten opduiken tijdens het renderen of, erger nog, na publicatie.

Toon beschermde elementen in review

Reviewers moeten functionele inhoud kunnen herkennen zonder erdoor afgeleid te worden.

Gebruik subtiele styling voor placeholders en beschermde termen. Maak linktekst bewerkbaar terwijl het doel zichtbaar blijft en apart beheerd wordt. Toon voor embedded content een menselijk leesbaar label naast de onveranderlijke ID.

Als een reviewer bewust een URL voor een doelmarkt moet wijzigen, behandel dat dan als een afzonderlijke beslissing voor een gelokaliseerd veld in plaats van als een onbedoeld neveneffect van het vertalen van proza.

Test met adversariële voorbeelden

Het ideale scenario is niet genoeg. Neem strings op met herhaalde variabelen, aangrenzende interpunctie, geneste markdown, meervoudsvormen, rechts-naar-links-tekst en placeholders die op gewone woorden lijken.

Beschermingslogica moet bewijzen dat deze gevallen zonder verlies round-trip kunnen doorlopen voordat ze wordt vertrouwd met productiecontent.

De kern

Vertaalkwaliteit omvat functionele integriteit.

Extraheer beschermde inhoud, vertaal alleen in aanmerking komende taal, behoud de rich-textstructuur, valideer het resultaat en maak functionele elementen duidelijk tijdens review. Een vloeiende zin is alleen waardevol wanneer de pagina nog steeds werkt nadat die is gepubliceerd.