Zurück zum Blog

Reliability · 19. Aug. 2026

Platzhalter, Links und Bezeichner in der KI-Übersetzung schützen

Flüssige Ausgabe allein reicht nicht aus, wenn ein geändertes Token die Seite beschädigen kann. Übersetzungs-Workflows müssen funktionale Inhalte schützen, bevor die Generierung beginnt.

Platzhalter, Links und Bezeichner in der KI-Übersetzung schützen

Einige der wichtigsten Teile einer Übersetzung sollten überhaupt nicht übersetzt werden.

Variablen, URLs, Eintrags-IDs, Asset-Referenzen, Codebeispiele und Formatierungsmarker tragen Funktion statt Prosa. Ein Modell kann einen natürlich klingenden Satz erzeugen und dabei unbemerkt eines dieser Elemente ändern und das umgebende Erlebnis beeinträchtigen.

Zuverlässige KI-Übersetzung beginnt damit, Sprache von Struktur zu trennen.

Geschützte Inhalte vor dem Prompt identifizieren

Verlassen Sie sich nicht auf eine allgemeine Anweisung wie "Platzhalter beibehalten." Identifizieren Sie zuerst die genauen Tokens und Knoten, die erhalten bleiben müssen.

Geschützte Inhalte umfassen häufig:

  • Interpolationsvariablen wie {first_name} oder {{ total }}
  • ICU-Nachrichtensyntax und Plural-Selektoren
  • URLs, E-Mail-Adressen und Routenfragmente
  • HTML-Attribute und Ziele von Markdown-Links
  • Contentful-Eintrags- und Asset-Referenzen
  • Inline-Code, eingezäunte Codeblöcke und API-Werte
  • als nicht übersetzbar markierte Produktnamen

Das Inhaltsmodell und der Feldtyp sollten dabei helfen, die Schutzregeln zu bestimmen. Ein Rich-Text-Dokument benötigt eine strukturelle Behandlung, die sich von der eines Klartext-Titels unterscheidet.

Riskante Werte durch stabile Tokens ersetzen

Für einfache Strings ist ein robuster Ansatz, geschützte Werte zu extrahieren und sie vor der Übersetzung durch eindeutige temporäre Tokens zu ersetzen.

Das Modell sieht die umgebende Sprache, kann aber nicht versehentlich eine Ziel-URL oder einen Bezeichner umschreiben. Nach der Generierung stellt der Workflow die ursprünglichen Werte aus einer serverseitigen Zuordnung wieder her.

Tokens sollten eindeutig, schwer mit natürlicher Sprache zu verwechseln und vor der Wiederherstellung validiert sein. Verlassen Sie sich niemals darauf, dass das Modell die Zuordnung selbst reproduziert.

Rich Text als Struktur übersetzen

Das Abflachen eines Rich-Text-Baums in Markdown oder HTML kann wichtige Unterscheidungen verlieren.

Textknoten sind übersetzbar. Links, eingebettete Einträge, Knotentypen und Auszeichnungen sind strukturell. Durchlaufen Sie den Dokumentbaum, übersetzen Sie zulässige Text-Blätter und bauen Sie die ursprüngliche Hierarchie mit unveränderten Referenzen wieder auf.

Das verbessert auch die Prüfung. Redakteure können dieselbe Struktur in beiden Gebietsschemata vergleichen, anstatt eine serialisierte Annäherung zu prüfen, die fehlende oder umsortierte Knoten verbergen kann.

Die Ausgabe vor dem Speichern validieren

Schutz braucht einen geschlossenen Kreislauf.

Verifizieren Sie nach der Übersetzung, dass jedes erwartete Token genau dort erscheint, wo das Format es zulässt, und dass kein unbekanntes Token eingeführt wurde. Parsen Sie strukturierte Formate, anstatt sie mit einem lockeren String-Vergleich zu prüfen.

Nützliche Fehler sind spezifisch:

  • fehlender Platzhalter {total}
  • geändertes Link-Ziel im Feld ctaBody
  • ungültige ICU-Syntax im Gebietsschema de
  • unerwartete Anzahl von Rich-Text-Knoten

Fehlerhafte Ausgabe an dieser Grenze zurückzuweisen ist sicherer, als das Problem erst beim Rendern oder, schlimmer noch, nach der Veröffentlichung auftreten zu lassen.

Geschützte Elemente in der Prüfung anzeigen

Prüfer sollten funktionale Inhalte erkennen können, ohne von ihnen abgelenkt zu werden.

Verwenden Sie eine dezente Gestaltung für Platzhalter und geschützte Begriffe. Machen Sie den Linktext bearbeitbar, während das Ziel sichtbar und separat gesteuert bleibt. Zeigen Sie bei eingebetteten Inhalten eine menschenlesbare Bezeichnung neben der unveränderlichen ID an.

Wenn ein Prüfer absichtlich eine URL für den Zielmarkt ändern muss, behandeln Sie das als eine eigenständige Entscheidung für ein lokalisiertes Feld und nicht als unbeabsichtigten Nebeneffekt der Übersetzung von Prosa.

Mit adversarialen Beispielen testen

Der Idealfall reicht nicht aus. Schließen Sie Strings mit wiederholten Variablen, angrenzender Interpunktion, verschachteltem Markdown, Pluralformen, rechts-nach-links verlaufendem Text und Platzhaltern ein, die gewöhnlichen Wörtern ähneln.

Die Schutzlogik sollte nachweisen, dass sie diese Fälle verlustfrei hin- und zurückführen kann, bevor man ihr Produktionsinhalte anvertraut.

Das Fazit

Zur Übersetzungsqualität gehört funktionale Integrität.

Extrahieren Sie geschützte Inhalte, übersetzen Sie nur zulässige Sprache, bewahren Sie die Rich-Text-Struktur, validieren Sie das Ergebnis und machen Sie funktionale Elemente während der Prüfung klar erkennbar. Ein flüssiger Satz ist nur dann wertvoll, wenn die Seite nach der Veröffentlichung immer noch funktioniert.