La plupart de ces mots viennent d'articles de recherche et n'ont jamais été traduits. En en connaissant six, une conversation qui déraille mystérieusement devient un problème que vous savez situer.
Les deux à apprendre en premier sont fenêtre de contexte et mémoire persistante, parce que presque toute plainte qui commence par « le personnage a oublié » revient à les confondre.
Le personnage lui-même
La persona — la couche d'identité du personnage : nom, voix, attitude, passé, tics. C'est ce que le modèle doit incarner à chaque réponse, sans exception.
Le prompt système — le bloc d'instructions caché que le modèle reçoit avant de produire quoi que ce soit. Ici, il porte la persona, les règles de la scène en cours et l'extrait de mémoire propre à ce lecteur.
La fiche de personnage — un paquet portable contenant persona, message d'ouverture, modèle par défaut et paramètres d'échantillonnage. Plusieurs formats communautaires existent : c'est ainsi que les personnages circulent d'une plateforme à l'autre.
La mémoire, et ce qu'on prend pour elle
La fenêtre de contexte — la quantité maximale de texte qu'un modèle peut garder en tête pour une réponse. Les grandes fenêtres embrassent davantage de la conversation récente et coûtent plus cher par appel. C'est une limite, pas un stock : quand la conversation la dépasse, la partie la plus ancienne tombe, tout simplement.
La mémoire persistante — les faits qu'un personnage conserve sur vous d'une session à l'autre. C'est un tout autre mécanisme : trié, modifiable, et injecté dans le contexte à chaque réponse. Ici, elle est par personnage, par sujet, par lecteur, et entièrement visible pour vous.
C'est la distinction qui règle la majorité des plaintes. Un personnage qui oublie quelque chose d'il y a une heure, c'est un effet de fenêtre de contexte. Un personnage qui oublie le prénom de votre sœur, c'est un problème d'enregistrement en mémoire — et si le fait n'a jamais été écrit, aucun modèle ne s'en souviendra correctement.
Le token — l'unité élémentaire qu'un modèle lit et écrit, environ quatre caractères d'anglais. Les fenêtres de contexte se mesurent en tokens, ce qui explique qu'une limite qui paraît énorme se remplisse plus vite que prévu.
Piloter une conversation
La branche, ou bifurcation — un point de divergence. Bifurquer depuis une réponse crée un fil alternatif qui grandit à côté de l'original, et les deux sont conservés. C'est ce qui rend l'essai d'une autre direction gratuit plutôt que destructeur.
Régénérer — demander une autre version de la dernière réponse sans rien déranger d'autre. Même contexte, nouvelle réponse.
Les réglages
La température — à quel point les réponses sont prévisibles. Plus basse, c'est plus stable ; plus haute, c'est plus surprenant. Un personnage qui paraît plat est souvent un problème de température plutôt qu'un problème de modèle.
top_p, top_k, min_p — des contraintes sur les mots candidats que le modèle envisage. Utiles pour régler le registre : prudent, expressif, sec, bavard.
La pénalité de répétition — décourage la réutilisation des formules. C'est le correctif pour un personnage qui replace sa réplique préférée une réponse sur quatre.
La tuyauterie
Le routeur de modèles — l'infrastructure qui choisit un modèle pour une scène dans un ensemble et bascule en silence quand l'un se dégrade.
Bascule et coupe-circuit — le routeur écarte un prestataire qui se dégrade avant qu'il n'empoisonne une conversation avec des délais ou des refus, et envoie le trafic vers un prestataire sain. Quand cela fonctionne, vous ne le remarquez jamais, et c'est bien le but.
Sur les bords
Telegram Stars — l'unité de micropaiement intégrée à Telegram, achetée dans Telegram et dépensée en options. Aucune carte n'est nécessaire pour la recharge elle-même.
Lien de partage — une URL à attribution suivie qui ouvre une conversation avec le personnage d'un créateur. Les Stars dépensées par ceux qui arrivent par là reversent une part au créateur.
Sujet — un fil de forum dédié dans Telegram, utilisé pour donner à chaque personnage sa propre pièce, avec son historique et ses messages épinglés.
Vérification d'âge — l'étape de contrôle dans le bot avant que le jeu de rôle adulte puisse être activé. Le site public est tout public ; le mode adulte est volontaire après la vérification, et les limites dures restent en place quoi qu'il arrive.
RTL — l'écriture de droite à gauche, utilisée pour l'arabe, l'hébreu et le persan. Les éléments d'interface sont mis en miroir plutôt que laissés en texte aligné à gauche dans une langue alignée à droite.