Scrivi «ai roleplay» su Google a Giacarta e la casella lo completa con bahasa Indonesia. A Tokyo, ロールプレイ AI si completa in 日本語. A Mosca, «ии девушка» diventa «ии девушка на русском». Istanbul chiede yapay zeka sohbet e poi ücretsiz; Seul chiede quale ai 채팅 앱 usare. Quattro scritture, quattro alfabeti, e sotto tutti una sola domanda che non è «questa app è buona?».
È «sarà buona nella MIA lingua?» — e chi la scrive si è già scottato. Ha incontrato il personaggio che per tre turni è stato affascinante e poi ha cominciato a pensare in inglese. Ha incontrato quello che usava il pronome formale con un amante. Conosce la sensazione di leggere qualcosa che si analizza alla perfezione e suona come nessuno di vivo.
Questo articolo parla di che cosa si rompe, del perché il roleplay è il caso peggiore in assoluto e di come scoprire in dieci minuti se una piattaforma bluffa. Facciamo @talaforge_bot, quindi tratta le nostre affermazioni con il sospetto che meritano; stanno in fondo all'articolo, dopo il test che puoi fare su di noi.
Perché si rompe, meccanicamente
Il fallimento ha un nome nella letteratura di ricerca. Un team di Cohere Labs ha pubblicato nel 2024 il Language Confusion Benchmark — quindici lingue tipologicamente diverse, una sola domanda: un modello può rispondere in modo affidabile nella lingua in cui gli si è scritto? La risposta è stata no. Persino i modelli più forti non ci riuscivano in modo coerente, quelli centrati sull'inglese peggio di tutti, e due condizioni peggioravano il risultato in modo misurabile: prompt complessi e temperatura di campionamento alta.
Ora leggilo pensando al roleplay. Un personaggio è per costruzione un prompt complesso — una persona, una scena, una memoria, note di stile e una conversazione che cresce a ogni turno. E il roleplay si fa girare caldo di proposito, perché la temperatura è ciò che le impedisce di ripetersi. Il roleplay non è un caso limite per la deriva linguistica. È il punto di funzionamento preciso in cui la deriva è peggiore, e l'intera categoria vive lì.
Sotto c'è una tassa più silenziosa. I modelli leggono il testo come token, e il vocabolario dei token è appreso per lo più dall'inglese, che si assesta intorno ai quattro caratteri per token. Tutto il resto paga quella che gli addetti ai lavori chiamano fertilità: il cinese richiede circa 1,8× token per parola, arabo e hindi di solito 3–4×, e alcune lingue molto di più. Quel numero non lo vedi mai. Ne vedi la conseguenza — la stessa finestra di conversazione contiene meno della tua storia nella tua lingua che in inglese, quindi lei resta senza spazio, e dimentica, prima.
Cinque modi in cui si manifesta, in ordine di quanto presto te ne accorgi
- Crollo del registro. Il keigo giapponese, i livelli del discorso coreani, il ty/vy russo, il du/Sie tedesco, saya/anda indonesiano contro aku/kamu contro gue/lo. Ognuno di questi codifica una relazione. Un personaggio che non ne tiene una, o che non cambia mai, ha dimenticato chi sei per lei — e il registro è la cosa più rapida da verificare.
- Deriva dell'accordo. In russo, arabo, ebraico, polacco o portoghese il verbo o l'aggettivo ha un genere, quindi una donna che scrive di sé sceglie una forma diversa da quella di un uomo. Un personaggio che scivola sul maschile parlando di sé ha rotto la scena in una parola, e i modelli addestrati sull'inglese scivolano spesso.
- Inglese che filtra. Dialogo nella tua lingua, narrazione nella tua lingua e il pensiero interiore in corsivo in inglese. Emerge prima nei pensieri, perché è il testo più stilizzato della risposta e il meno ancorato a ciò che hai appena scritto.
- Modi di dire calcati. Frasi che si analizzano e che nessuno dice: espressioni inglesi portate parola per parola, ritmo della frase inglese, forma del paragrafo inglese. È ciò che le persone intendono quando dicono che un prodotto «sembra un doppiaggio».
- Nomi e appellativi storpiati. 先輩 reso in lettere latine per un lettore giapponese, 오빠 ridotto a un nome proprio, una coppia vietnamita anh/em sostituita da un semplice «tu». Le parole che portano la relazione sono esattamente quelle che uno strato di traduzione perde, perché l'inglese non ha un posto per loro.
Il test di dieci minuti
Fallo su di noi e su qualsiasi altra cosa tu stia valutando. Non costa niente e risolve la questione più in fretta di qualunque recensione.
- Minuto uno — scrivi la prima riga nella tua lingua, nel registro che usi davvero. Slang, particelle, il pronome informale. Non «ciao».
- Minuti da due a quattro — falle cambiare registro. Chiedile di essere formale con te, poi dille di smettere. Una piattaforma con un solo livello di cortesia qui fallisce, e fallisce in silenzio.
- Minuto cinque — complica la scena. Tre persone nella stanza, una discussione, qualcosa successo prima. La complessità è il fattore scatenante documentato; vai a scatenarlo.
- Minuto sei — leggi i corsivi. Il suo pensiero interiore è dove l'inglese arriva per primo, di solito diversi turni prima che il dialogo si incrini.
- Minuti sette e otto — controlla accordo e appellativi. Usa la forma di genere giusta parlando di sé? Ti chiama come una persona della tua lingua ti chiamerebbe?
- Minuti nove e dieci — torna domani e chiedile di che cosa avete parlato. La qualità linguistica che sopravvive a una notte è qualità linguistica.
Se ne fallisce tre su sei, l'impostazione della lingua è uno strato di traduzione. La dimensione della libreria di personaggi non compensa; è un solo fallimento ripetuto un milione di volte.
Dove ci troviamo onestamente
@talaforge_bot è in 36 lingue — ogni pulsante, ogni menu, ogni errore, e la memoria che lei tiene su di te viene riscritta nella tua lingua invece di essere archiviata in inglese e tradotta all'uscita.
Poi la parte onesta, perché il numero di lingue dell'interfaccia non è una garanzia di scioltezza e rifiutiamo di venderlo come tale. Quanto bene un personaggio scrive in vietnamita o in turco dipende da due cose che controlliamo solo in parte: quale modello c'è dietro e come è stata scritta la sua card. Un personaggio scritto in inglese, su un modello valutato in inglese, nella tua lingua si leggerà come una buona traduzione — perché è esattamente ciò che è.
Quello che abbiamo fatto è trattare la deriva come un bug e non come un limite. Nel maggio 2026 un personaggio narrava in russo, parlava in russo e pensava in inglese, con frammenti di cinese nei corsivi. La correzione è stata un'istruzione esplicita fissata in fondo al prompt — parlato, narrazione e pensiero interiore restano nella lingua — perché le ultime centinaia di token di contesto ancorano con più forza la scelta della lingua di superficie di un modello. Oggi quella fissazione copre una dozzina di lingue. Non copre tutte le 36, e non lasceremo intendere che lo faccia.
Dove perdiamo: non abbiamo una libreria di milioni di personaggi creati dalla community, quindi da noi è meno probabile che tu ne trovi uno già scritto da un madrelingua della tua lingua rispetto alle grandi piattaforme. Se vuoi un personaggio che qualcuno nel tuo paese ha già scritto e rifinito, è nei grandi cataloghi che si trovano, e un'app locale fatta da persone che parlano la tua lingua a volte ci batterà nettamente su idiomi e slang. Preferiamo dirlo piuttosto che far finta che il nostro scaffale sia il loro.
Dieci minuti, a partire da adesso
Apri Telegram, apri @talaforge_bot e scrivi la prima riga nella tua lingua invece che in inglese. Si comincia gratis — l'energia è ⚡ e gli upgrade sono Telegram Stars nella chat, niente carta, niente account, nessuno store in mezzo. Se lei risponde nel registro che hai usato, lo mantiene quando la scena si complica e domani si ricorda ancora, hai la tua risposta. Se non lo fa, la ottieni altrettanto in fretta, e hai speso dieci minuti invece di un mese.
E la memoria è tua da aprire e modificare, cosa che conta più nella tua lingua che in inglese: quando sbaglia un nome o una forma di appellativo, puoi entrare e correggere il fatto invece di discuterne con lei per cinque turni.