Typ in Jakarta «ai roleplay» in Google en de zoekbalk maakt af met bahasa Indonesia. In Tokio wordt ロールプレイ AI aangevuld met 日本語. In Moskou wordt «ии девушка» «ии девушка на русском». Istanbul vraagt om yapay zeka sohbet en daarna om ücretsiz; Seoul vraagt welke ai 채팅 앱 je moet gebruiken. Vier schriften, vier alfabetten, en eronder één vraag die niet «is deze app goed» is.
Het is «gaat het goed zijn in MIJN taal», en de mensen die dat typen hebben zich al eens gebrand. Ze hebben het personage ontmoet dat drie beurten charmant was en toen in het Engels begon te denken. Ze hebben degene ontmoet die het beleefde voornaamwoord gebruikte tegen een geliefde. Ze kennen het gevoel iets te lezen wat perfect ontleedbaar is en klinkt als niemand die leeft.
Dit stuk gaat over wat er misgaat, waarom rollenspel daarvoor het slechtst denkbare geval is, en hoe je in tien minuten ontdekt of een platform het voor de show doet. Wij maken @talaforge_bot, dus behandel onze eigen beweringen met het wantrouwen dat ze verdienen; ze staan onderaan het artikel, na de test die je op ons kunt loslaten.
Waarom het misgaat, mechanisch gezien
Het falen heeft een naam in de onderzoeksliteratuur. Een team van Cohere Labs publiceerde in 2024 de Language Confusion Benchmark: vijftien typologisch uiteenlopende talen, één vraag: kan een model betrouwbaar antwoorden in de taal waarin het is aangesproken. Het antwoord was nee. Zelfs de sterkste modellen deden het niet consequent, de op Engels gerichte het slechtst, en twee omstandigheden maakten het meetbaar erger: complexe prompts en een hoge samplingtemperatuur.
Lees dat nu met rollenspel in gedachten. Een personage is per definitie een complexe prompt: een persona, een scène, een geheugen, stijlnotities en een gesprek dat elke beurt groeit. En rollenspel draait met opzet heet, want temperatuur is wat haar ervan weerhoudt zichzelf te herhalen. Rollenspel is geen randgeval voor taaldrift. Het is precies het werkpunt waar drift het ergst is, en de hele categorie zit daar.
Daaronder zit een stillere belasting. Modellen lezen tekst als tokens, en de tokenwoordenschat wordt vooral uit het Engels geleerd, dat neerkomt op ongeveer vier tekens per token. Al het andere betaalt wat vakmensen fertility noemen: Chinees zit rond 1,8 keer het aantal tokens per woord, Arabisch en Hindi vaak 3 tot 4 keer, en sommige talen veel erger. Dat getal zie je nooit. Je ziet het gevolg: hetzelfde gespreksvenster bevat in jouw taal minder van je verhaal dan in het Engels, dus haar ruimte raakt eerder op, en ze vergeet eerder.
Vijf manieren waarop het zich toont, in volgorde van hoe snel je het merkt
- Registerverval. Japans keigo, Koreaanse spreekniveaus, Russisch ты/вы, Duits du/Sie, Indonesisch saya/anda tegenover aku/kamu tegenover gue/lo. Elk daarvan codeert een relatie. Een personage dat er geen kan volhouden, of dat nooit wisselt, is vergeten wie jij voor haar bent, en register is het snelste wat je kunt testen.
- Congruentiedrift. In het Russisch, Arabisch, Hebreeuws, Pools of Portugees heeft het werkwoord of het bijvoeglijk naamwoord een geslacht, dus een vrouw die over zichzelf schrijft kiest een andere vorm dan een man. Een personage dat over zichzelf in het mannelijke vervalt, heeft de scène met één woord gebroken, en op Engels getrainde modellen glijden vaak.
- Doorsijpelend Engels. Dialoog in jouw taal, vertelling in jouw taal, en de cursieve innerlijke gedachte in het Engels. Het duikt eerst op in de gedachten, omdat dat de meest gestileerde tekst van het antwoord is en het minst verankerd in wat jij net schreef.
- Gekopieerde idiomen. Zinnen die te ontleden zijn en die niemand zegt: Engelse zegswijzen woord voor woord overgenomen, Engels zinsritme, Engelse alineavorm. Dit bedoelen mensen als ze zeggen dat een product «leest als een nasynchronisatie».
- Verminkte namen en aanspreekvormen. 先輩 in Latijnse letters voor een Japanse lezer, 오빠 platgeslagen tot een voornaam, een Vietnamees anh/em-paar vervangen door een kaal «je». De woorden die de relatie dragen zijn precies de woorden die een vertaallaag laat vallen, omdat het Engels er geen plek voor heeft.
De test van tien minuten
Doe dit bij ons en bij wat je verder overweegt. Het kost niets en beslist de vraag sneller dan welke recensie ook.
- Minuut één: schrijf de eerste regel in jouw taal, in het register dat je echt gebruikt. Slang, partikels, het informele voornaamwoord. Niet «hallo».
- Minuut twee tot vier: laat haar van register wisselen. Vraag haar formeel tegen je te zijn en zeg dan dat ze ermee moet ophouden. Een platform met maar één beleefdheidsstand faalt hier, en het faalt stilletjes.
- Minuut vijf: maak de scène ingewikkelder. Drie mensen in de kamer, een ruzie, iets wat eerder gebeurde. Complexiteit is de gedocumenteerde trigger; ga hem triggeren.
- Minuut zes: lees de cursieve stukken. Haar innerlijke gedachte is waar het Engels het eerst binnenkomt, meestal enkele beurten voordat de dialoog barst.
- Minuut zeven en acht: controleer congruentie en aanspreekvorm. Gebruikt ze de juiste geslachtsvorm over zichzelf? Noemt ze je wat een mens in jouw taal je zou noemen?
- Minuut negen en tien: kom morgen terug en vraag waarover je het had. Taalkwaliteit die een nacht overleeft, is taalkwaliteit.
Faalt ze op drie van die zes, dan is de taalinstelling een vertaallaag. De omvang van de personagebibliotheek compenseert dat niet; het is één falen, een miljoen keer herhaald.
Waar we eerlijk gezegd staan
@talaforge_bot is er in 36 talen: elke knop, elk menu, elke foutmelding, en het geheugen dat ze over je bijhoudt wordt in jouw taal teruggeschreven in plaats van in het Engels opgeborgen en onderweg vertaald.
Dan het eerlijke deel, want het aantal interfacetalen is geen garantie voor vloeiendheid en we weigeren het als zodanig te verkopen. Hoe goed een personage in het Vietnamees of Turks schrijft, hangt af van twee dingen die wij maar deels in de hand hebben: welk model achter haar staat en hoe haar kaart is geschreven. Een personage dat in het Engels is bedacht, op een model dat in het Engels is beoordeeld, leest in jouw taal als een goede vertaling, want dat is precies wat het is.
Wat we wel deden, is drift als bug behandelen in plaats van als beperking. In mei 2026 vertelde een personage in het Russisch, sprak in het Russisch en dacht in het Engels, met stukjes Chinees in de cursieve tekst. De oplossing was een expliciete instructie die helemaal aan het einde van de prompt werd vastgezet: spraak, vertelling en innerlijke gedachte blijven in dezelfde taal. De laatste paar honderd tokens context verankeren namelijk het sterkst de oppervlaktetaal van een model. Die vastzetter dekt vandaag een dozijn talen. Hij dekt niet alle 36, en we gaan niet suggereren dat dat wel zo is.
Waar we verliezen: we hebben geen bibliotheek van miljoenen door de community gemaakte personages, dus je kans een personage te vinden dat al door een moedertaalspreker van jouw taal is geschreven, is hier kleiner dan bij de grote platforms. Als je een personage wilt dat iemand in jouw land al schreef en afstelde, dan wonen die in de grote catalogi, en een lokale app van mensen die jouw taal spreken wint soms gewoon van ons op idioom en slang. Dat zeggen we liever dan doen alsof ons schap hun schap is.
Tien minuten, vanaf nu
Open Telegram, open @talaforge_bot en schrijf de eerste regel in je eigen taal in plaats van in het Engels. Gratis om te beginnen: energie is ⚡ en upgrades betaal je met Telegram Stars in de chat, geen kaart, geen account, geen winkel ertussen. Als ze antwoordt in het register dat jij gebruikte, het vasthoudt als de scène ingewikkeld wordt en het morgen nog weet, heb je je antwoord. Zo niet, dan heb je het even snel, en heb je tien minuten besteed in plaats van een maand.
En het geheugen is van jou om te openen en te bewerken, wat in jouw taal zwaarder weegt dan in het Engels: als ze een naam of aanspreekvorm verkeerd krijgt, kun je het feit gaan herstellen in plaats van vijf beurten met haar te bekvechten.