Hai digitato «prompt per roleplay ai», hai trovato un elenco di cinquanta e ne hai incollato uno. La prima risposta era buona, la quarta era poltiglia, e sei andato a cercare un elenco migliore — perché la spiegazione più ovvia è che avessi il prompt sbagliato.
Non è così. Lo stesso paragrafo che con un personaggio produce una scena tesa e precisa, con un altro produce carta da parati, e le liste non sanno dire perché — dovrebbero scrivere di qualcosa che non sono i prompt.
Un prompt è la cosa più piccola che il modello vede
A ogni turno al modello arrivano quattro cose: la persona del personaggio, la conversazione fin lì, i fatti in memoria e il messaggio che hai appena scritto. Il tuo è il più corto e l'ultimo ad arrivare. Dà una spinta; non comanda.
Per questo i pacchetti di prompt funzionano come gli oroscopi. «Sei un detective sfinito in una città dove non smette mai di piovere» fa miracoli su un personaggio la cui persona è fatta di due righe vaghe, perché finalmente fornisce ciò che mancava. Incollalo su un personaggio scritto bene e gli avrai consegnato una seconda identità in contraddizione con la prima — che si sente tre risposte dopo, come una voce che continua a scivolare.
Esiste quindi una gerarchia: prima la persona, poi il messaggio iniziale, poi la memoria e solo alla fine ciò che scrivi tu. La maggior parte delle persone la percorre al contrario e ne conclude che l'AI è scadente.
Che cosa deve stare nel personaggio
Tre cose, e nessuna è la lunghezza.
- Una contraddizione. Chi è solo gentile non ha dove andare; chi è gentile e lo trova faticoso ha una scena in ogni conversazione.
- I silenzi. Se non parla mai della guerra, di suo fratello o del motivo per cui se n'è andata — scrivilo. Un modello non può dedurre un silenzio che hai solo immaginato.
- Il registro, mostrato e non descritto. «Frasi brevi, non finisce mai una battuta sarcastica» vale più di un paragrafo sulla sua personalità: dà un'istruzione sull'output invece di enunciare un fatto su una persona.
Qui la descrizione del catalogo e la persona sono campi diversi, e solo uno arriva al modello: la descrizione è il testo di presentazione che una persona legge mentre sfoglia, la persona è ciò che le viene chiesto di essere a ogni risposta. Scrivere il tuo paragrafo migliore nella descrizione è il modo più comune in cui del buon materiale non va da nessuna parte. Articolo di approfondimento: che cosa controlli davvero.
Il messaggio iniziale è il tuo unico esempio svolto
Il messaggio iniziale viene salvato come il suo primo turno, quindi sta nella conversazione che il modello legge — e al messaggio uno è l'unico campione della sua voce che esista. Lunghezza, tempo verbale, persona grammaticale, se narra o si limita a parlare: tutto viene copiato, e continua a esserlo, perché ogni risposta imita la precedente.
«Ciao! Sono Mara. Come ti chiami? Che cosa ti va di fare oggi?» le insegna qualcosa di poco utile: che fa domande e aspetta. Confrontalo con uno che fa il suo lavoro — «Il bar è vuoto da quando ha cominciato a piovere. Mara asciuga un bicchiere che ha già asciugato dieci minuti fa e alza lo sguardo quando la porta si apre. — Sei tu quello che ha chiamato per la stanza di sopra. Non è una domanda.» Un luogo, un momento, qualcosa appena successo, una battuta nella sua voce.
E siccome i fatti su di te vivono nella memoria e non nel saluto, un'apertura non ha nemmeno bisogno di presentarti. Ogni personaggio ha una memoria leggibile e modificabile, quindi ciò che dici una volta non va ripetuto — ed è questo che libera l'apertura e le permette di essere una scena. L'argomentazione completa è qui.
Aperture che stabiliscono invece di interrogare
Il tuo primo messaggio è l'altra metà di quel lavoro: un posto dove stare, qualcosa da notare, una cosa lasciata senza spiegazione.
- «È l'ultima ora del tuo turno e mi siedo all'estremità del bancone con una cartella che chiaramente non voglio aprire. Non chiedermi ancora cosa c'è dentro.»
- «Siamo in macchina da un'ora e nessuno dei due ha parlato dopo la svolta. Sono io quello che prende l'uscita in anticipo, senza dire perché.»
- «Mi trovi sulla scala antincendio alle due di notte. Ti dico che non riuscivo a dormire. Non è per questo che sono qui fuori.»
La cosa taciuta è il motore: dà a lei un motivo per insistere e a te una carta da giocare più avanti. La forma da evitare è «Sei un signore dei vampiri, io sono il tuo servitore, comincia» — è una premessa, non una scena.
Guidare a metà scena senza uscirne
Quando una risposta si sposta, l'istinto è scrivere un'istruzione. Funziona una volta e costa ogni volta: l'istruzione resta nella conversazione, e un contesto pieno di indicazioni di regia insegna al modello che questa è una discussione su una scena.
- Guida restando dentro la finzione. Vuoi risposte più brevi? Scrivine di più brevi — lei rispecchia la lunghezza dei tuoi turni nel giro di qualche scambio. Vuoi che sia meno accondiscendente? Fai qualcosa a cui lei si opporrebbe.
- Usa con parsimonia una parentesi fuori scena: «[Fuori dal personaggio: un paragrafo breve per risposta.]» Una funziona; quattro trasformano la scena in una riunione di produzione.
- Modifica la risposta invece di rigenerarla — lo strumento che nessuno usa e quello con più leva. Tutto ciò che tieni diventa l'esempio che la risposta successiva imita: riduci tre paragrafi a quello buono e la risposta dopo arriva in quella forma. E quando una scena può andare in due modi, fai un fork invece di discutere.
Quando si è appiattita, è una di tre cose
- Non è rimasta nessuna questione aperta: hai risolto la tensione due scambi fa. Porta dentro qualcosa da fuori della stanza — un bussare, un messaggio, una scadenza.
- Sei d'accordo con tutto, quindi l'unica mossa che le resta è essere d'accordo a sua volta. Dissenti una volta, nel personaggio, e dillo sul serio.
- Il contesto si è riempito delle tue istruzioni. Inizia una nuova trama con lei: la memoria porta con sé i fatti, le indicazioni di regia no.
E rigenera due volte, non otto. Se due tentativi tornano fiacchi, il problema sta a monte dei dadi.
I cursori, in parole semplici
- La temperatura è quanto il modello è disposto a scegliere una parola successiva meno ovvia. Bassa è coerente e un po' piatta; alta sembra inventiva, fino al punto in cui dimentica un nome che ha usato una pagina prima.
- Top P restringe il campo alle opzioni più probabili prima della scelta — abbassato molto la rende affidabile e un po' robotica, ed è un freno più pulito della temperatura.
- Le penalità di ripetizione e di frequenza spingono lontano dalle parole già usate: una piccola dose cura un personaggio fermo su un solo aggettivo, troppa e smette di usare il tuo nome, che è anch'esso una parola ripetuta.
Il riassunto onesto: i cursori cambiano la resa, non il giudizio — come suona una frase, non se c'è qualcosa in gioco. Un personaggio profondo tre aggettivi non diventa più profondo con una temperatura più alta.
Quello che il prompt non può sistemare
- Non può far ricordare a un modello. «Ricordati che lavoro di notte» dura quanto questa conversazione e sparisce la settimana dopo, a meno che non sia scritto da qualche parte.
- Non può mantenere una regola per sempre: tutto ciò che ripeti ogni poche battute va nella persona o nella memoria.
- Non può salvare un personaggio fatto di tre aggettivi, e non sposta il limite sui contenuti: il roleplay per adulti sta dietro una conferma di maggiore età (18+) nel bot.
Dove un concorrente è migliore, lo diciamo chiaro: per un mondo di lunga durata con lore condizionale — voci che scattano solo quando compare un luogo o un nome — SillyTavern ha i lorebook e una nota dell'autore inserita a una profondità fissa, e noi non abbiamo né l'uno né l'altra. Una card si importa con persona, messaggio iniziale e parametri di campionamento; un lorebook no. Se il tuo modo di lavorare è quello, è lo strumento migliore, e Chub e Janitor hanno librerie di card molto più grandi del nostro catalogo.
Il test di dieci minuti
- Apri la persona di un personaggio che si è appiattito. Aggiungi una contraddizione e una cosa di cui non parla mai — due frasi.
- Riscrivi la sua apertura come una scena: luogo, momento, qualcosa appena successo, una battuta nella sua voce. Cancella i punti interrogativi.
- Apri la sua memoria e cancella la riga sbagliata. Di solito ce n'è una.
- Inizia una nuova trama e manda una delle aperture qui sopra.
- Quando una risposta è giusta all'ottanta per cento, riducila a mano invece di rigenerare, e guarda la successiva.
Se dopo dieci minuti di modifiche e zero modelli nuovi lei è migliore, quella è la risposta a ciò che cercavi. Il bot è @talaforge_bot; si apre in Telegram, non c'è niente da installare e nessuna registrazione.