Vocabolario

I termini del roleplay AI, spiegati semplice

Persona, system prompt, finestra di contesto, memoria persistente, biforcazione, temperatura. Cosa significa davvero ogni termine e quali contano quando qualcosa va storto.

Talaforge › I termini del roleplay AI, spiegati semplice

Quasi tutte queste parole sono arrivate dagli articoli di ricerca e non sono mai state tradotte. Conoscerne sei trasforma una chat che si comporta male in modo misterioso in un problema che sai localizzare.

I due da imparare per primi sono finestra di contesto e memoria persistente, perché quasi ogni lamentela che inizia con «il personaggio si è dimenticato» nasce dal confonderli.

Il personaggio in sé

Persona — lo strato dell'identità del personaggio: nome, voce, atteggiamento, storia, modi di fare. È ciò che al modello viene chiesto di incarnare a ogni singola risposta.

System prompt — il blocco di istruzioni nascosto che il modello riceve prima di generare qualunque cosa. Qui contiene la persona, le regole della scena attiva e il frammento di memoria relativo a quel lettore specifico.

Character card — un pacchetto trasportabile fatto di persona, messaggio di apertura, modello predefinito e parametri di campionamento. Esistono diversi formati standard nella community ed è così che i personaggi si spostano tra le piattaforme.

La memoria, e ciò che spesso viene scambiato per essa

Finestra di contesto — la quantità massima di testo che un modello può tenere a mente per una singola risposta. Finestre più grandi richiamano più conversazione recente e costano di più a chiamata. È un limite, non un magazzino: quando una conversazione lo supera, la parte più vecchia semplicemente cade fuori.

Memoria persistente — i fatti che un personaggio conserva su di te da una sessione all'altra. È un meccanismo del tutto diverso: curato, modificabile e iniettato nel contesto a ogni risposta. Qui è per personaggio, per argomento e per lettore, e per te completamente visibile.

È questa la distinzione che risolve quasi tutte le lamentele. Un personaggio che dimentica qualcosa di un'ora fa è un effetto della finestra di contesto. Un personaggio che dimentica il nome di tua sorella è un problema di registrazione in memoria — e se quel fatto non è mai stato scritto, nessun modello se lo ricorderà nel modo giusto.

Token — l'unità atomica che un modello legge e scrive, all'incirca quattro caratteri di inglese. Le finestre di contesto si misurano in token, ed è per questo che un limite dal suono enorme si riempie più in fretta del previsto.

Dirigere una conversazione

Ramo, o fork — un punto di divergenza. Biforcare da una risposta crea un filo alternativo che cresce accanto all'originale, e vengono tenuti entrambi. È questo che rende provare una direzione diversa gratuito invece che distruttivo.

Rigenerare — chiedere un'altra versione dell'ultima risposta senza toccare nient'altro. Stesso contesto, risposta nuova.

Le manopole

Temperatura — quanto sono prevedibili le risposte. Più bassa è più stabile, più alta è più sorprendente. Un personaggio che sembra piatto è spesso un problema di temperatura e non di modello.

top_p, top_k, min_p — vincoli su quali parole candidate il modello prende in considerazione. Utili per regolare il registro: cauto, espressivo, secco, prolisso.

Penalità di ripetizione — scoraggia il riuso delle stesse frasi. È il rimedio per un personaggio che ripete la sua battuta preferita ogni quattro risposte.

Sotto il cofano

Router dei modelli — l'infrastruttura che sceglie da un insieme quale modello serve una scena e passa in silenzio a un altro quando uno peggiora.

Failover e circuit breaker — il router che stacca un fornitore in degrado prima che possa avvelenare una conversazione con timeout o rifiuti, e manda il traffico a uno sano. Quando funziona non te ne accorgi, ed è proprio il punto.

Ai margini

Telegram Stars — l'unità di micropagamento integrata in Telegram, comprata dentro Telegram e spesa nei potenziamenti. Per la ricarica in sé non serve nessuna carta.

Link di condivisione — un URL con attribuzione tracciata che apre una chat con il personaggio di un creatore. Le Stars spese da chi arriva da lì fanno guadagnare al creatore una quota.

Argomento — un thread dedicato del forum di Telegram, usato per dare a ogni personaggio una stanza propria con la sua cronologia e la sua striscia di messaggi fissati.

Verifica dell'età — il passaggio di verifica dentro il bot prima che si possa attivare il roleplay per adulti. Il sito pubblico è SFW; la modalità per adulti si attiva volontariamente dopo la verifica, e i limiti fermi restano comunque.

RTL — la scrittura da destra a sinistra, usata per arabo, ebraico e persiano. Gli elementi dell'interfaccia vengono specchiati invece di essere testo allineato a sinistra dentro una lingua allineata a destra.

Che differenza c'è tra finestra di contesto e memoria?
La finestra di contesto è quanto testo un modello può tenere a mente per una singola risposta — un limite, misurato in token, da cui la conversazione più vecchia cade fuori. La memoria persistente è un insieme curato e modificabile di fatti conservati su di te e iniettati in ogni risposta. Quasi tutte le lamentele del tipo «si è dimenticato una cosa» sono la prima; quasi tutte quelle del tipo «si è dimenticato di me» sono la seconda.
Che cos'è un system prompt nel roleplay AI?
Il blocco di istruzioni nascosto che il modello riceve prima di scrivere qualunque cosa. Porta con sé la persona del personaggio, le regole della scena in corso e il frammento di memoria che riguarda te in particolare — ed è per questo che lo stesso personaggio può comportarsi diversamente con due lettori diversi.
Che cos'è una character card?
Un pacchetto trasportabile che contiene una persona, un messaggio di apertura, un modello predefinito e i parametri di campionamento. Esistono diversi formati standard nella community, ed è così che un personaggio scritto su una piattaforma può essere importato in un'altra.
Che cosa fa davvero la temperatura?
Regola quanto è prevedibile la parola successiva. Valori più bassi rendono le risposte più stabili e più ripetitive; valori più alti le rendono più sorprendenti e meno controllate. Un personaggio che si legge piatto molto spesso è impostato troppo basso, più che essere sul modello sbagliato.
Che cosa significa biforcare una conversazione?
Diramarsi da una risposta in un filo alternativo tenendo l'originale. Entrambi continuano a esistere e a crescere separatamente, così provare una direzione diversa non costa nulla.
Che cos'è un token?
L'unità che un modello legge e scrive — all'incirca quattro caratteri di testo inglese. I limiti di contesto si contano in token, quindi una finestra che a numeri sembra grande contiene meno conversazione di quanto sembri.
Che cos'è un router dei modelli?
L'infrastruttura che sceglie quale modello serve una scena e si sposta via da uno che comincia a fallire, prima che timeout o rifiuti raggiungano la conversazione. Quando funziona bene è invisibile.
Crea un personaggio in Telegram →

Continua a leggere