Presque tout le monde demande quel modèle est le meilleur et attend un nom. La réponse honnête, c'est qu'il manque la moitié de la question : meilleur pour quoi ? Un modèle qui écrit une prose magnifique et lente perdra le fil de l'intrigue au bout de quarante réponses, et celui qui tient l'intrigue écrira comme un rapport compétent.
Vous n'avez pas à trancher une fois pour toutes. Le personnage, sa personnalité et tout ce dont il se souvient sont séparés du modèle qui produit les mots : changer est donc un choix par scène, pas un engagement.
Ce que chaque type sait faire
Cinq sont disponibles, et ce sont de vrais instruments différents, pas cinq tailles de la même chose.
- Standard — celui sur lequel démarre chaque nouveau personnage. Rapide, régulier et suffisant pour la plupart des scènes. Vous n'avez jamais à le choisir : il est déjà là.
- GLM — un cran au-dessus quand une scène se complique. Logique plus serrée, et il tient un plan sur un long échange.
- Claude Opus — la prose et le sous-texte les plus riches. Les scènes qui montent lentement, la retenue précise, les personnages qui suggèrent plus qu'ils ne disent.
- Google Gemma — rapide, chaleureux et joueur. Bon pour les échanges légers et les allers-retours sans poids.
- DeepSeek — tient ensemble de longues histoires pleines de détours sans perdre le fil.
Comment savoir qu'on est sur le mauvais
Les symptômes sont précis, et une fois qu'on les connaît on arrête de deviner.
Les réponses sont belles mais l'intrigue s'est arrêtée sans bruit. Quelqu'un a promis quelque chose trois scènes plus tôt et personne n'en a reparlé. C'est un problème de raisonnement — allez vers GLM ou DeepSeek.
Tout est cohérent et rien ne touche. Le personnage dit exactement ce qu'il pense, dans l'ordre, sans sous-texte. C'est un problème de prose, et c'est à ça que sert Claude Opus.
La scène est devenue raide et formelle alors qu'elle devrait être légère. Un modèle plus chaleureux et plus rapide convient mieux qu'un modèle plus puissant ; c'est là que Gemma gagne sa place.
Le personnage contredit un élément établi depuis longtemps. Vérifiez la mémoire avant d'accuser le modèle : si le fait n'a jamais été écrit, aucun modèle ne l'inventera correctement.
Changer ne réinitialise rien
Le modèle ne fait pas partie du personnage. La persona, la mémoire, la scène et l'historique restent exactement où ils étaient ; seule change la chose qui produit la réponse suivante.
Cela rend le changement assez peu coûteux pour servir d'outil plutôt que de décision. Un usage courant : un modèle rapide pour les allers-retours de la scène, et un passage à un modèle plus riche pour le moment qui compte — un aveu, une confrontation, une fin.
Une chose à prévoir : la voix se décale légèrement. Deux modèles nourris de la même persona ne sonnent pas pareil, et en plein paragraphe la couture peut se voir. Changer entre deux scènes plutôt qu'à l'intérieur d'une seule la masque presque entièrement.
L'échantillonnage compte plus qu'on ne le croit
Le choix du modèle fixe le plafond ; les paramètres d'échantillonnage décident où vous tombez dans cette plage. La température règle à quel point une réponse est prévisible — plus basse, c'est plus stable ; plus haute, c'est plus surprenant. Les autres (top_p, top_k, min_p, la pénalité de répétition) restreignent les mots candidats que le modèle envisage.
Un modèle qui paraît plat est souvent un problème de température plutôt qu'un problème de modèle. Un personnage qui ressort sa réplique préférée une réponse sur quatre est un problème de pénalité de répétition.
Ils sont accessibles par personnage et par offre, et s'exportent et s'importent en JSON : un jeu de valeurs qui fonctionne se garde et se déplace au lieu d'être refait de mémoire à chaque fois.
Ce que cette sélection est, et ce qu'elle n'est pas
Cinq modèles, choisis parce qu'ils couvrent des terrains vraiment différents, pas pour qu'un chiffre fasse bonne impression. La sélection évolue à mesure que de meilleurs modèles apparaissent — c'est une décision d'aiguillage, pas une promesse sur des noms précis.
Il n'y a pas de classement ici parce que le classement dépend entièrement de la scène devant vous. Une page qui vous affirme qu'un modèle est simplement le meilleur pour le jeu de rôle n'a pas essayé une scène qui en demandait un autre.