Veldnotities · Taal

Is een AI-personage echt goed in mijn taal, of is het Engels met een vertaallaag?

In Jakarta, Tokio, Moskou, Istanbul en Seoul maakt de zoekbalk dezelfde zin af: mensen plakken hun eigen taal achter de zoekopdracht. Ze stellen een vraag die niemand rechtuit beantwoordt. Dit is wat er echt misgaat, waarom rollenspel daarvoor het slechtste geval is, en een test van tien minuten die het op elk platform beslist.

2026-09-126 min lezen Alle veldnotities
Is een AI-personage echt goed in mijn taal, of is het Engels met een vertaallaag?

Typ in Jakarta «ai roleplay» in Google en de zoekbalk maakt af met bahasa Indonesia. In Tokio wordt ロールプレイ AI aangevuld met 日本語. In Moskou wordt «ии девушка» «ии девушка на русском». Istanbul vraagt om yapay zeka sohbet en daarna om ücretsiz; Seoul vraagt welke ai 채팅 앱 je moet gebruiken. Vier schriften, vier alfabetten, en eronder één vraag die niet «is deze app goed» is.

Het is «gaat het goed zijn in MIJN taal», en de mensen die dat typen hebben zich al eens gebrand. Ze hebben het personage ontmoet dat drie beurten charmant was en toen in het Engels begon te denken. Ze hebben degene ontmoet die het beleefde voornaamwoord gebruikte tegen een geliefde. Ze kennen het gevoel iets te lezen wat perfect ontleedbaar is en klinkt als niemand die leeft.

Dit stuk gaat over wat er misgaat, waarom rollenspel daarvoor het slechtst denkbare geval is, en hoe je in tien minuten ontdekt of een platform het voor de show doet. Wij maken @talaforge_bot, dus behandel onze eigen beweringen met het wantrouwen dat ze verdienen; ze staan onderaan het artikel, na de test die je op ons kunt loslaten.

Waarom het misgaat, mechanisch gezien

Het falen heeft een naam in de onderzoeksliteratuur. Een team van Cohere Labs publiceerde in 2024 de Language Confusion Benchmark: vijftien typologisch uiteenlopende talen, één vraag: kan een model betrouwbaar antwoorden in de taal waarin het is aangesproken. Het antwoord was nee. Zelfs de sterkste modellen deden het niet consequent, de op Engels gerichte het slechtst, en twee omstandigheden maakten het meetbaar erger: complexe prompts en een hoge samplingtemperatuur.

Lees dat nu met rollenspel in gedachten. Een personage is per definitie een complexe prompt: een persona, een scène, een geheugen, stijlnotities en een gesprek dat elke beurt groeit. En rollenspel draait met opzet heet, want temperatuur is wat haar ervan weerhoudt zichzelf te herhalen. Rollenspel is geen randgeval voor taaldrift. Het is precies het werkpunt waar drift het ergst is, en de hele categorie zit daar.

Daaronder zit een stillere belasting. Modellen lezen tekst als tokens, en de tokenwoordenschat wordt vooral uit het Engels geleerd, dat neerkomt op ongeveer vier tekens per token. Al het andere betaalt wat vakmensen fertility noemen: Chinees zit rond 1,8 keer het aantal tokens per woord, Arabisch en Hindi vaak 3 tot 4 keer, en sommige talen veel erger. Dat getal zie je nooit. Je ziet het gevolg: hetzelfde gespreksvenster bevat in jouw taal minder van je verhaal dan in het Engels, dus haar ruimte raakt eerder op, en ze vergeet eerder.

Vijf manieren waarop het zich toont, in volgorde van hoe snel je het merkt

De test van tien minuten

Doe dit bij ons en bij wat je verder overweegt. Het kost niets en beslist de vraag sneller dan welke recensie ook.

Faalt ze op drie van die zes, dan is de taalinstelling een vertaallaag. De omvang van de personagebibliotheek compenseert dat niet; het is één falen, een miljoen keer herhaald.

Waar we eerlijk gezegd staan

@talaforge_bot is er in 36 talen: elke knop, elk menu, elke foutmelding, en het geheugen dat ze over je bijhoudt wordt in jouw taal teruggeschreven in plaats van in het Engels opgeborgen en onderweg vertaald.

Dan het eerlijke deel, want het aantal interfacetalen is geen garantie voor vloeiendheid en we weigeren het als zodanig te verkopen. Hoe goed een personage in het Vietnamees of Turks schrijft, hangt af van twee dingen die wij maar deels in de hand hebben: welk model achter haar staat en hoe haar kaart is geschreven. Een personage dat in het Engels is bedacht, op een model dat in het Engels is beoordeeld, leest in jouw taal als een goede vertaling, want dat is precies wat het is.

Wat we wel deden, is drift als bug behandelen in plaats van als beperking. In mei 2026 vertelde een personage in het Russisch, sprak in het Russisch en dacht in het Engels, met stukjes Chinees in de cursieve tekst. De oplossing was een expliciete instructie die helemaal aan het einde van de prompt werd vastgezet: spraak, vertelling en innerlijke gedachte blijven in dezelfde taal. De laatste paar honderd tokens context verankeren namelijk het sterkst de oppervlaktetaal van een model. Die vastzetter dekt vandaag een dozijn talen. Hij dekt niet alle 36, en we gaan niet suggereren dat dat wel zo is.

Waar we verliezen: we hebben geen bibliotheek van miljoenen door de community gemaakte personages, dus je kans een personage te vinden dat al door een moedertaalspreker van jouw taal is geschreven, is hier kleiner dan bij de grote platforms. Als je een personage wilt dat iemand in jouw land al schreef en afstelde, dan wonen die in de grote catalogi, en een lokale app van mensen die jouw taal spreken wint soms gewoon van ons op idioom en slang. Dat zeggen we liever dan doen alsof ons schap hun schap is.

Tien minuten, vanaf nu

Open Telegram, open @talaforge_bot en schrijf de eerste regel in je eigen taal in plaats van in het Engels. Gratis om te beginnen: energie is ⚡ en upgrades betaal je met Telegram Stars in de chat, geen kaart, geen account, geen winkel ertussen. Als ze antwoordt in het register dat jij gebruikte, het vasthoudt als de scène ingewikkeld wordt en het morgen nog weet, heb je je antwoord. Zo niet, dan heb je het even snel, en heb je tien minuten besteed in plaats van een maand.

En het geheugen is van jou om te openen en te bewerken, wat in jouw taal zwaarder weegt dan in het Engels: als ze een naam of aanspreekvorm verkeerd krijgt, kun je het feit gaan herstellen in plaats van vijf beurten met haar te bekvechten.

Werkt Talaforge in mijn taal?
De bot en de Mini App zijn er in 36 talen, dus als de jouwe erbij zit, is de hele interface erin en wordt het geheugen dat ze bijhoudt er ook in geschreven. Hoe goed een bepaald personage erin schrijft, hangt af van het model erachter en van hoe haar kaart is geschreven. Daar dient de test van tien minuten hierboven voor.
Waarom schakelen AI-personages midden in een scène over op Engels?
Het heet taalverwarring en het is gemeten: de Language Confusion Benchmark van 2024 vond dat zelfs de sterkste modellen niet consequent antwoorden in de taal waarin hun iets werd gevraagd, en dat complexe prompts en een hoge samplingtemperatuur het erger maken. Rollenspel is beide tegelijk, en daarom komt het hier vaker voor dan in een assistentchat.
Is een vertaalde interface hetzelfde als een meertalig personage?
Nee, en ze door elkaar halen is de meest gebruikelijke goocheltruc van de branche. Knoppen vertalen is een week werk. Een register, een geslachtsvorm en een idioom volhouden over een lange scène is een eigenschap van het model en van hoe het personage is geschreven, en geen instellingenscherm kan dat toevoegen.
Is een lokale app in mijn taal beter dan een wereldwijde?
Soms, echt waar. Producten die door en voor één markt zijn gemaakt, winnen vaak op slang, idioom en aanspreekvormen, omdat de mensen die ze schrijven de taal elke dag horen. Wereldwijde producten winnen meestal op modelkwaliteit, geheugen en hoe lang een scène kan doorlopen. Test beide dezelfde avond met hetzelfde personage: de verschillen tonen zich binnen tien minuten.
Heb ik een account, een app of een kaart nodig om het te proberen?
Nee. Het is een bot in Telegram: je opent een chat en schrijft. Gratis om te beginnen, energie is ⚡ en upgrades betaal je met Telegram Stars in de chat zelf.

Lees verder

Maak een personage in Telegram →