Reliability · 19 sie 2026
Chroń placeholdery, linki i identyfikatory w tłumaczeniu AI
Płynny tekst wyjściowy nie wystarcza, gdy zmieniony token może zepsuć stronę. Procesy tłumaczeniowe muszą chronić treści funkcjonalne, zanim rozpocznie się generowanie.

Niektórych z najważniejszych elementów tłumaczenia w ogóle nie należy tłumaczyć.
Zmienne, adresy URL, identyfikatory wpisów, odwołania do zasobów, przykłady kodu i znaczniki formatowania pełnią funkcję, a nie rolę prozy. Model może wygenerować naturalnie brzmiące zdanie, jednocześnie po cichu zmieniając jeden z tych elementów i psując otaczające go działanie.
Niezawodne tłumaczenie AI zaczyna się od oddzielenia języka od struktury.
Zidentyfikuj chronione treści przed promptem
Nie polegaj na ogólnej instrukcji takiej jak "zachowaj placeholdery". Najpierw zidentyfikuj dokładne tokeny i węzły, które muszą pozostać bez zmian.
Chronione treści zwykle obejmują:
- zmienne interpolacyjne takie jak
{first_name}lub{{ total }} - składnię komunikatów ICU i selektory liczby mnogiej
- adresy URL, adresy e-mail i fragmenty ścieżek
- atrybuty HTML i miejsca docelowe linków markdown
- odwołania do wpisów i zasobów Contentful
- fragmenty kodu inline, bloki kodu fenced i wartości API
- nazwy produktów oznaczone jako nietłumaczalne
Model treści i typ pola powinny pomagać w określaniu zasad ochrony. Dokument rich text wymaga obsługi strukturalnej innej niż zwykły tytuł w postaci prostego tekstu.
Zastąp ryzykowne wartości stabilnymi tokenami
W przypadku zwykłych ciągów tekstowych jednym z solidnych podejść jest wyodrębnienie chronionych wartości i zastąpienie ich jednoznacznymi tymczasowymi tokenami przed tłumaczeniem.
Model widzi otaczający język, ale nie może przypadkowo przepisać docelowego adresu URL ani identyfikatora. Po wygenerowaniu proces przywraca oryginalne wartości z mapy po stronie serwera.
Tokeny powinny być unikalne, trudne do pomylenia z językiem naturalnym i walidowane przed przywróceniem. Nigdy nie ufaj modelowi, że sam odtworzy mapę.
Tłumacz rich text jako strukturę
Spłaszczanie drzewa rich text do markdown lub HTML może prowadzić do utraty ważnych rozróżnień.
Węzły tekstowe są tłumaczalne. Linki, osadzone wpisy, typy węzłów i znaczniki są strukturalne. Przechodź przez drzewo dokumentu, tłumacz kwalifikujące się liście tekstowe i odtwarzaj oryginalną hierarchię, pozostawiając odwołania bez zmian.
To poprawia również proces recenzji. Redaktorzy mogą porównywać tę samą strukturę w obu wersjach językowych zamiast sprawdzać zserializowane przybliżenie, które może ukrywać brakujące lub przestawione węzły.
Zweryfikuj wynik przed zapisaniem
Ochrona wymaga zamkniętej pętli.
Po tłumaczeniu sprawdź, czy każdy oczekiwany token pojawia się dokładnie tam, gdzie pozwala na to format, i czy nie został wprowadzony żaden nieznany token. Parsuj formaty strukturalne zamiast sprawdzać je za pomocą luźnego porównania ciągów.
Przydatne błędy są konkretne:
- brak placeholdera
{total} - zmienione miejsce docelowe linku w polu
ctaBody - nieprawidłowa składnia ICU w ustawieniach regionalnych
de - nieoczekiwana liczba węzłów rich text
Odrzucenie nieprawidłowego wyniku na tej granicy jest bezpieczniejsze niż pozwolenie, by problem ujawnił się podczas renderowania lub, co gorsza, po publikacji.
Pokaż chronione elementy w recenzji
Recenzenci powinni móc rozpoznawać treści funkcjonalne bez rozpraszania się nimi.
Używaj subtelnego stylu dla placeholderów i chronionych terminów. Umożliwiaj edycję tekstu linku, jednocześnie zachowując widoczne miejsce docelowe i oddzielną kontrolę nad nim. W przypadku osadzonych treści pokazuj czytelną dla człowieka etykietę obok niezmiennego identyfikatora.
Jeśli recenzent celowo musi zmienić adres URL dla rynku docelowego, potraktuj to jako odrębną decyzję dotyczącą zlokalizowanego pola, a nie przypadkowy efekt uboczny tłumaczenia prozy.
Testuj na przykładach adwersarialnych
Szczęśliwa ścieżka nie wystarczy. Uwzględnij ciągi z powtarzającymi się zmiennymi, sąsiadującą interpunkcją, zagnieżdżonym markdownem, formami liczby mnogiej, tekstem pisanym od prawej do lewej i placeholderami przypominającymi zwykłe słowa.
Logika ochrony powinna wykazać, że potrafi bezstratnie przeprowadzić te przypadki w obie strony, zanim zostanie jej zaufane w pracy z treściami produkcyjnymi.
Najważniejszy wniosek
Jakość tłumaczenia obejmuje integralność funkcjonalną.
Wyodrębnij chronione treści, tłumacz tylko kwalifikujący się język, zachowuj strukturę rich text, waliduj wynik i wyraźnie pokazuj elementy funkcjonalne podczas recenzji. Płynne zdanie ma wartość tylko wtedy, gdy strona nadal działa po publikacji.