Vocabulaire

Les termes du jeu de rôle IA, expliqués simplement

Persona, prompt système, fenêtre de contexte, mémoire persistante, bifurcation, température. Ce que chaque terme veut vraiment dire, et lesquels comptent quand ça dérape.

Talaforge › Les termes du jeu de rôle IA, expliqués simplement

La plupart de ces mots viennent d'articles de recherche et n'ont jamais été traduits. En en connaissant six, une conversation qui déraille mystérieusement devient un problème que vous savez situer.

Les deux à apprendre en premier sont fenêtre de contexte et mémoire persistante, parce que presque toute plainte qui commence par « le personnage a oublié » revient à les confondre.

Le personnage lui-même

La persona — la couche d'identité du personnage : nom, voix, attitude, passé, tics. C'est ce que le modèle doit incarner à chaque réponse, sans exception.

Le prompt système — le bloc d'instructions caché que le modèle reçoit avant de produire quoi que ce soit. Ici, il porte la persona, les règles de la scène en cours et l'extrait de mémoire propre à ce lecteur.

La fiche de personnage — un paquet portable contenant persona, message d'ouverture, modèle par défaut et paramètres d'échantillonnage. Plusieurs formats communautaires existent : c'est ainsi que les personnages circulent d'une plateforme à l'autre.

La mémoire, et ce qu'on prend pour elle

La fenêtre de contexte — la quantité maximale de texte qu'un modèle peut garder en tête pour une réponse. Les grandes fenêtres embrassent davantage de la conversation récente et coûtent plus cher par appel. C'est une limite, pas un stock : quand la conversation la dépasse, la partie la plus ancienne tombe, tout simplement.

La mémoire persistante — les faits qu'un personnage conserve sur vous d'une session à l'autre. C'est un tout autre mécanisme : trié, modifiable, et injecté dans le contexte à chaque réponse. Ici, elle est par personnage, par sujet, par lecteur, et entièrement visible pour vous.

C'est la distinction qui règle la majorité des plaintes. Un personnage qui oublie quelque chose d'il y a une heure, c'est un effet de fenêtre de contexte. Un personnage qui oublie le prénom de votre sœur, c'est un problème d'enregistrement en mémoire — et si le fait n'a jamais été écrit, aucun modèle ne s'en souviendra correctement.

Le token — l'unité élémentaire qu'un modèle lit et écrit, environ quatre caractères d'anglais. Les fenêtres de contexte se mesurent en tokens, ce qui explique qu'une limite qui paraît énorme se remplisse plus vite que prévu.

Piloter une conversation

La branche, ou bifurcation — un point de divergence. Bifurquer depuis une réponse crée un fil alternatif qui grandit à côté de l'original, et les deux sont conservés. C'est ce qui rend l'essai d'une autre direction gratuit plutôt que destructeur.

Régénérer — demander une autre version de la dernière réponse sans rien déranger d'autre. Même contexte, nouvelle réponse.

Les réglages

La température — à quel point les réponses sont prévisibles. Plus basse, c'est plus stable ; plus haute, c'est plus surprenant. Un personnage qui paraît plat est souvent un problème de température plutôt qu'un problème de modèle.

top_p, top_k, min_p — des contraintes sur les mots candidats que le modèle envisage. Utiles pour régler le registre : prudent, expressif, sec, bavard.

La pénalité de répétition — décourage la réutilisation des formules. C'est le correctif pour un personnage qui replace sa réplique préférée une réponse sur quatre.

La tuyauterie

Le routeur de modèles — l'infrastructure qui choisit un modèle pour une scène dans un ensemble et bascule en silence quand l'un se dégrade.

Bascule et coupe-circuit — le routeur écarte un prestataire qui se dégrade avant qu'il n'empoisonne une conversation avec des délais ou des refus, et envoie le trafic vers un prestataire sain. Quand cela fonctionne, vous ne le remarquez jamais, et c'est bien le but.

Sur les bords

Telegram Stars — l'unité de micropaiement intégrée à Telegram, achetée dans Telegram et dépensée en options. Aucune carte n'est nécessaire pour la recharge elle-même.

Lien de partage — une URL à attribution suivie qui ouvre une conversation avec le personnage d'un créateur. Les Stars dépensées par ceux qui arrivent par là reversent une part au créateur.

Sujet — un fil de forum dédié dans Telegram, utilisé pour donner à chaque personnage sa propre pièce, avec son historique et ses messages épinglés.

Vérification d'âge — l'étape de contrôle dans le bot avant que le jeu de rôle adulte puisse être activé. Le site public est tout public ; le mode adulte est volontaire après la vérification, et les limites dures restent en place quoi qu'il arrive.

RTL — l'écriture de droite à gauche, utilisée pour l'arabe, l'hébreu et le persan. Les éléments d'interface sont mis en miroir plutôt que laissés en texte aligné à gauche dans une langue alignée à droite.

Quelle est la différence entre fenêtre de contexte et mémoire ?
La fenêtre de contexte, c'est la quantité de texte qu'un modèle peut garder en tête pour une seule réponse — une limite, mesurée en tokens, dont la conversation la plus ancienne finit par sortir. La mémoire persistante est un ensemble trié et modifiable de faits conservés sur vous et injectés à chaque réponse. La plupart des « il a oublié un détail » relèvent de la première ; la plupart des « il m'a oublié » relèvent de la seconde.
Qu'est-ce qu'un prompt système en jeu de rôle IA ?
Le bloc d'instructions caché que le modèle reçoit avant d'écrire quoi que ce soit. Il porte la persona du personnage, les règles de la scène en cours et l'extrait de mémoire qui vous concerne précisément — c'est pourquoi le même personnage peut se comporter différemment avec deux lecteurs.
Qu'est-ce qu'une fiche de personnage ?
Un paquet portable contenant une persona, un message d'ouverture, un modèle par défaut et des paramètres d'échantillonnage. Plusieurs formats communautaires existent, et c'est ainsi qu'un personnage écrit sur une plateforme peut être importé sur une autre.
Que fait réellement la température ?
Elle règle à quel point le mot suivant est prévisible. Des valeurs basses rendent les réponses plus stables et plus répétitives ; des valeurs hautes les rendent plus surprenantes et moins maîtrisées. Un personnage qui paraît plat est bien plus souvent réglé trop bas que placé sur le mauvais modèle.
Que veut dire bifurquer une conversation ?
Partir d'une réponse vers un fil alternatif tout en gardant l'original. Les deux continuent d'exister et de grandir séparément, donc essayer une autre direction ne coûte rien.
Qu'est-ce qu'un token ?
L'unité qu'un modèle lit et écrit — environ quatre caractères de texte anglais. Les limites de contexte se comptent en tokens : une fenêtre qui semble grande en chiffres contient moins de conversation qu'il n'y paraît.
Qu'est-ce qu'un routeur de modèles ?
L'infrastructure qui choisit quel modèle sert une scène et s'écarte de celui qui commence à défaillir, avant que délais ou refus n'atteignent la conversation. Quand elle fonctionne, elle est invisible.
Créer un personnage dans Telegram →

À lire ensuite