Quasi tutte queste parole sono arrivate dagli articoli di ricerca e non sono mai state tradotte. Conoscerne sei trasforma una chat che si comporta male in modo misterioso in un problema che sai localizzare.
I due da imparare per primi sono finestra di contesto e memoria persistente, perché quasi ogni lamentela che inizia con «il personaggio si è dimenticato» nasce dal confonderli.
Il personaggio in sé
Persona — lo strato dell'identità del personaggio: nome, voce, atteggiamento, storia, modi di fare. È ciò che al modello viene chiesto di incarnare a ogni singola risposta.
System prompt — il blocco di istruzioni nascosto che il modello riceve prima di generare qualunque cosa. Qui contiene la persona, le regole della scena attiva e il frammento di memoria relativo a quel lettore specifico.
Character card — un pacchetto trasportabile fatto di persona, messaggio di apertura, modello predefinito e parametri di campionamento. Esistono diversi formati standard nella community ed è così che i personaggi si spostano tra le piattaforme.
La memoria, e ciò che spesso viene scambiato per essa
Finestra di contesto — la quantità massima di testo che un modello può tenere a mente per una singola risposta. Finestre più grandi richiamano più conversazione recente e costano di più a chiamata. È un limite, non un magazzino: quando una conversazione lo supera, la parte più vecchia semplicemente cade fuori.
Memoria persistente — i fatti che un personaggio conserva su di te da una sessione all'altra. È un meccanismo del tutto diverso: curato, modificabile e iniettato nel contesto a ogni risposta. Qui è per personaggio, per argomento e per lettore, e per te completamente visibile.
È questa la distinzione che risolve quasi tutte le lamentele. Un personaggio che dimentica qualcosa di un'ora fa è un effetto della finestra di contesto. Un personaggio che dimentica il nome di tua sorella è un problema di registrazione in memoria — e se quel fatto non è mai stato scritto, nessun modello se lo ricorderà nel modo giusto.
Token — l'unità atomica che un modello legge e scrive, all'incirca quattro caratteri di inglese. Le finestre di contesto si misurano in token, ed è per questo che un limite dal suono enorme si riempie più in fretta del previsto.
Dirigere una conversazione
Ramo, o fork — un punto di divergenza. Biforcare da una risposta crea un filo alternativo che cresce accanto all'originale, e vengono tenuti entrambi. È questo che rende provare una direzione diversa gratuito invece che distruttivo.
Rigenerare — chiedere un'altra versione dell'ultima risposta senza toccare nient'altro. Stesso contesto, risposta nuova.
Le manopole
Temperatura — quanto sono prevedibili le risposte. Più bassa è più stabile, più alta è più sorprendente. Un personaggio che sembra piatto è spesso un problema di temperatura e non di modello.
top_p, top_k, min_p — vincoli su quali parole candidate il modello prende in considerazione. Utili per regolare il registro: cauto, espressivo, secco, prolisso.
Penalità di ripetizione — scoraggia il riuso delle stesse frasi. È il rimedio per un personaggio che ripete la sua battuta preferita ogni quattro risposte.
Sotto il cofano
Router dei modelli — l'infrastruttura che sceglie da un insieme quale modello serve una scena e passa in silenzio a un altro quando uno peggiora.
Failover e circuit breaker — il router che stacca un fornitore in degrado prima che possa avvelenare una conversazione con timeout o rifiuti, e manda il traffico a uno sano. Quando funziona non te ne accorgi, ed è proprio il punto.
Ai margini
Telegram Stars — l'unità di micropagamento integrata in Telegram, comprata dentro Telegram e spesa nei potenziamenti. Per la ricarica in sé non serve nessuna carta.
Link di condivisione — un URL con attribuzione tracciata che apre una chat con il personaggio di un creatore. Le Stars spese da chi arriva da lì fanno guadagnare al creatore una quota.
Argomento — un thread dedicato del forum di Telegram, usato per dare a ogni personaggio una stanza propria con la sua cronologia e la sua striscia di messaggi fissati.
Verifica dell'età — il passaggio di verifica dentro il bot prima che si possa attivare il roleplay per adulti. Il sito pubblico è SFW; la modalità per adulti si attiva volontariamente dopo la verifica, e i limiti fermi restano comunque.
RTL — la scrittura da destra a sinistra, usata per arabo, ebraico e persiano. Gli elementi dell'interfaccia vengono specchiati invece di essere testo allineato a sinistra dentro una lingua allineata a destra.