Notatki z terenu · Język

Czy postać AI naprawdę będzie dobra w moim języku, czy to angielski z warstwą tłumaczenia?

W Dżakarcie, Tokio, Moskwie, Stambule i Seulu wyszukiwarka kończy to samo zdanie: ludzie dopisują do zapytania własny język. Zadają pytanie, na które nikt nie odpowiada wprost. Oto co naprawdę się psuje, dlaczego roleplay jest najgorszym przypadkiem i dziesięciominutowy test, który rozstrzyga to na każdej platformie.

2026-09-126 min czytania Wszystkie notatki
Czy postać AI naprawdę będzie dobra w moim języku, czy to angielski z warstwą tłumaczenia?

Wpisz «ai roleplay» w Google w Dżakarcie, a pole dopowie bahasa Indonesia. W Tokio ロールプレイ AI uzupełnia się do 日本語. W Moskwie «ии девушка» zmienia się w «ии девушка на русском». Stambuł pyta o yapay zeka sohbet, a potem o ücretsiz; Seul dopytuje, której aplikacji ai 채팅 użyć. Cztery pisma, cztery alfabety, a pod nimi jedno pytanie, które nie brzmi «czy ta aplikacja jest dobra».

Brzmi ono «czy będzie dobra w MOIM języku» — a ludzie, którzy je wpisują, już się sparzyli. Spotkali postać, która była czarująca przez trzy tury, a potem zaczęła myśleć po angielsku. Spotkali taką, która używała formalnego zaimka wobec ukochanej osoby. Znają to uczucie czytania czegoś, co jest bezbłędne gramatycznie, a brzmi jak nikt żywy.

Ten tekst jest o tym, co się psuje, dlaczego roleplay to najgorszy możliwy przypadek i jak w dziesięć minut sprawdzić, czy platforma udaje. Robimy @talaforge_bot, więc do naszych własnych twierdzeń podchodź z podejrzliwością, na jaką zasługują; są na końcu artykułu, po teście, który możesz wykonać na nas.

Dlaczego się psuje, mechanicznie

Ta usterka ma w literaturze naukowej nazwę. Zespół Cohere Labs opublikował w 2024 roku Language Confusion Benchmark — piętnaście typologicznie zróżnicowanych języków, jedno pytanie: czy model potrafi niezawodnie odpowiedzieć w języku, w którym go zagadnięto. Odpowiedź brzmiała: nie. Nawet najsilniejsze modele nie robiły tego konsekwentnie, a najgorzej te zorientowane na angielski, przy czym dwa warunki mierzalnie pogarszały wynik: złożone prompty i wysoka temperatura próbkowania.

Przeczytaj to teraz z roleplayem w głowie. Postać to z konstrukcji złożony prompt — persona, scena, pamięć, notatki o stylu i rozmowa rosnąca z każdą turą. A roleplay prowadzi się celowo na gorąco, bo temperatura jest tym, co powstrzymuje ją przed powtarzaniem się. Roleplay nie jest przypadkiem brzegowym dla dryfu językowego. To dokładnie ten punkt pracy, w którym dryf jest najgorszy, i cała kategoria w nim mieszka.

Pod spodem siedzi cichszy podatek. Modele czytają tekst jako tokeny, a słownik tokenów uczy się głównie z angielskiego, który wypada mniej więcej na cztery znaki na token. Wszystko inne płaci to, co praktycy nazywają płodnością: chiński zużywa około 1,8× więcej tokenów na słowo, arabski i hindi zwykle 3–4×, a niektóre języki znacznie więcej. Tej liczby nigdy nie widzisz. Widzisz jej skutek — to samo okno rozmowy mieści mniej twojej historii w twoim języku niż po angielsku, więc jej kończy się miejsce i zapomina wcześniej.

Pięć sposobów, w jakie się to objawia, w kolejności, w jakiej to zauważysz

Test na dziesięć minut

Wykonaj go na nas i na wszystkim innym, co rozważasz. Nic nie kosztuje i rozstrzyga sprawę szybciej niż jakakolwiek recenzja.

Jeśli oblejesz trzy z tych sześciu, ustawienie języka to warstwa tłumaczenia. Rozmiar biblioteki postaci tego nie równoważy; to jedna porażka powtórzona milion razy.

Gdzie szczerze stoimy

@talaforge_bot działa w 36 językach — każdy przycisk, każde menu, każdy błąd, a pamięć, którą o tobie trzyma, jest zapisywana z powrotem w twoim języku, a nie składana po angielsku i tłumaczona w drodze na zewnątrz.

Teraz część szczera, bo liczba języków interfejsu nie jest gwarancją płynności i odmawiamy sprzedawania jej jako takiej. To, jak dobrze postać pisze po wietnamsku czy turecku, zależy od dwóch rzeczy, które kontrolujemy tylko częściowo: jaki model za nią stoi i jak napisano jej kartę. Postać napisana po angielsku, działająca na modelu ocenianym po angielsku, będzie w twoim języku brzmieć jak dobre tłumaczenie — bo dokładnie tym jest.

Zrobiliśmy za to jedno: potraktowaliśmy dryf jako błąd, a nie ograniczenie. W maju 2026 postać prowadziła narrację po rosyjsku, mówiła po rosyjsku, a myślała po angielsku, z fragmentami chińskiego w kursywie. Poprawką była jawna instrukcja przypięta na samym końcu promptu — mowa, narracja i myśl wewnętrzna równie pozostają w języku — bo ostatnie kilkaset tokenów kontekstu najmocniej kotwiczy wybór języka powierzchniowego przez model. To przypięcie obejmuje dziś kilkanaście języków. Nie obejmuje wszystkich 36 i nie zamierzamy sugerować, że tak jest.

Gdzie przegrywamy: nie mamy biblioteki milionów postaci stworzonych przez społeczność, więc szansa, że znajdziesz tu postać napisaną już przez native speakera twojego języka, jest mniejsza niż na dużych platformach. Jeśli chcesz postaci, którą ktoś w twoim kraju już napisał i dostroił, duże katalogi to miejsce, gdzie takie żyją, a lokalna aplikacja zrobiona przez ludzi mówiących twoim językiem czasem wprost nas pobije w idiomach i slangu. Wolimy to powiedzieć, niż udawać, że nasza półka to ich półka.

Dziesięć minut, zaczynając teraz

Otwórz Telegram, otwórz @talaforge_bot i napisz pierwszą linijkę w swoim języku, a nie po angielsku. Start za darmo — energia to ⚡, a ulepszenia to Telegram Stars w czacie, bez karty, bez konta, bez sklepu pośrodku. Jeśli odpowie w rejestrze, którego użyłeś, utrzyma go, gdy scena się skomplikuje, i jutro nadal będzie pamiętać, masz odpowiedź. Jeśli nie, masz ją równie szybko, a wydałeś dziesięć minut, nie miesiąc.

A pamięć jest twoja do otwarcia i edycji, co w twoim języku liczy się bardziej niż po angielsku: gdy pomyli imię lub formę zwrotu, możesz wejść i poprawić fakt, zamiast przez pięć tur się z nią o to spierać.

Czy Talaforge działa w moim języku?
Bot i Mini App są w 36 językach, więc jeśli twój jest wśród nich, cały interfejs jest w nim, a pamięć, którą postać trzyma, też jest w nim zapisana. To, jak dobrze dana postać w nim pisze, zależy od modelu za nią i od tego, jak napisano jej kartę — do tego służy powyższy test na dziesięć minut.
Dlaczego postacie AI przechodzą na angielski w środku sceny?
To się nazywa language confusion i jest zmierzone: Language Confusion Benchmark z 2024 roku wykazał, że nawet najsilniejsze modele nie potrafią konsekwentnie odpowiadać w języku, w którym je zagadnięto, a złożone prompty i wysoka temperatura próbkowania pogarszają sprawę. Roleplay to jedno i drugie naraz, dlatego pojawia się tu częściej niż w czacie z asystentem.
Czy przetłumaczony interfejs to to samo co wielojęzyczna postać?
Nie, a mylenie ich to najczęstsza sztuczka branży. Tłumaczenie przycisków to tydzień pracy. Utrzymanie rejestru, formy rodzajowej i idiomu w długiej scenie to cecha modelu i pisania postaci i żaden ekran ustawień jej nie doda.
Czy lokalna aplikacja w moim języku byłaby lepsza niż globalna?
Czasem naprawdę tak. Produkty robione przez ludzi i dla jednego rynku często wygrywają w slangu, idiomach i formach zwrotu, bo ci, którzy je piszą, słyszą ten język codziennie. Produkty globalne zwykle wygrywają jakością modelu, pamięcią i tym, jak długo może trwać scena. Przetestuj oba jednego wieczoru z tą samą postacią — różnice widać w dziesięć minut.
Czy potrzebuję konta, aplikacji lub karty, żeby spróbować?
Nie. To bot w Telegramie: otwierasz czat i piszesz. Start za darmo, energia to ⚡, a ulepszenia to Telegram Stars w samym czacie.

Czytaj dalej

Stwórz postać w Telegramie →