Elegir modelo

Qué modelo de IA es mejor para rol

No hay una única respuesta, y cualquier página que te dé una está vendiendo algo. Lo que viene es en qué es bueno de verdad cada tipo de modelo, y cómo notar a mitad de escena que estás en el equivocado.

Talaforge › Qué modelo de IA es mejor para rol

Casi todo el mundo pregunta qué modelo es el mejor y espera un nombre. La respuesta honesta es que a la pregunta le falta media frase: mejor ¿para qué? Un modelo que escribe una prosa preciosa a fuego lento perderá el hilo de la trama a las cuarenta respuestas, y el que sostiene la trama escribirá como un informe competente.

No tienes que decidirlo una sola vez. El personaje, su personalidad y todo lo que recuerda están separados del modelo que genera las palabras, así que cambiar es una elección por escena y no un compromiso.

En qué es bueno cada tipo

Hay cinco disponibles, y son instrumentos genuinamente distintos, no cinco tallas de lo mismo.

Cómo saber que estás en el equivocado

Los síntomas son concretos, y en cuanto los conoces dejas de adivinar.

Las respuestas son bonitas pero la trama ha dejado de moverse en silencio. Alguien prometió algo hace tres escenas y nadie lo ha vuelto a mencionar. Eso es un problema de razonamiento: muévete hacia GLM o DeepSeek.

Todo es coherente y nada te toca. El personaje dice exactamente lo que quiere decir, en orden, sin subtexto. Eso es un problema de prosa, y para eso está Claude Opus.

La escena se ha puesto rígida y formal cuando debería ir ligera. Ahí encaja mejor un modelo más cálido y rápido que uno más capaz; es donde Gemma se gana el sitio.

El personaje contradice algo establecido hace mucho. Revisa la memoria antes de culpar al modelo: si el dato no se escribió nunca, ningún modelo lo inventará bien.

Cambiar no reinicia nada

El modelo no es parte del personaje. La persona, la memoria, la escena y el historial se quedan exactamente donde estaban; lo único que cambia es lo que genera la siguiente respuesta.

Eso hace que cambiar salga lo bastante barato como para usarlo de herramienta y no de decisión. Un patrón habitual es un modelo rápido para el ida y vuelta de la escena y un salto a uno más rico para el momento que importa: una confesión, un enfrentamiento, un final.

Una cosa que esperar: la voz se desplazará un poco. Dos modelos con la misma persona no suenan idénticos, y a mitad de párrafo se puede notar la costura. Cambiar entre escenas en vez de dentro de una la esconde casi del todo.

El sampling importa más de lo que se cree

La elección de modelo fija el techo; los parámetros de sampling deciden en qué punto de ese rango caes. La temperatura controla lo predecible que es una respuesta: más baja es más estable, más alta es más sorprendente. Los demás (top_p, top_k, min_p, la penalización de repetición) limitan qué palabras candidatas llega siquiera a considerar el modelo.

Un modelo que se siente plano suele ser un problema de temperatura y no de modelo. Un personaje que repite su frase favorita cada cuarta respuesta es un problema de penalización de repetición.

Están a la vista por personaje y por paquete, y se exportan e importan como JSON, así que un conjunto de valores que funciona se puede guardar y mover en vez de rehacerlo de memoria cada vez.

Qué es y qué no es esta selección

Cinco modelos, elegidos porque cubren terreno genuinamente distinto y no para que el número quede vistoso. La selección cambia a medida que aparecen modelos mejores: es una decisión de enrutado, no una promesa sobre nombres concretos.

Aquí no hay ranking porque el ranking depende por completo de la escena que tienes delante. Una página que te dice que un modelo es sin más el mejor para rol no ha probado una escena que pidiera otro.

¿Qué modelo de IA es mejor para rol en general?
No hay uno mejor, y la prueba honesta es qué pide la escena. Prosa rica y subtexto apuntan a Claude Opus; tramas complicadas que deben mantenerse coherentes apuntan a GLM o DeepSeek; la charla ligera apunta a Gemma. Como el cambio es por escena, la respuesta práctica es cambiar de modelo cuando cambia la escena en vez de elegir una vez.
¿Cambiar de modelo hace que el personaje me olvide?
No. La memoria, la persona y el historial pertenecen al personaje, no al modelo. Cambiar solo altera lo que genera la siguiente respuesta: todo lo que el personaje sabe de ti pasa intacto.
¿Qué modelo es mejor para historias muy largas?
DeepSeek mantiene bien unidas narrativas largas y llenas de vueltas, y GLM conserva un plan coherente a lo largo de un intercambio largo. Pero aquí la memoria persistente hace más trabajo que la elección de modelo: un dato que nunca se escribió en la memoria no sobrevive a la longitud en ningún modelo.
¿Por qué suena distinto el personaje después de cambiar?
Dos modelos con la misma persona no suenan idénticos: el personaje es el mismo, la voz se desplaza un poco. Cambiar entre escenas en vez de a mitad de párrafo vuelve la costura prácticamente invisible.
¿Merece la pena el modelo mejor para charlar sin más?
Normalmente no. Standard es genuinamente suficiente para casi cualquier escena y es con el que arranca cada personaje nuevo. Los modelos más ricos se ganan el sitio en momentos concretos, no a lo largo de una conversación entera.
¿Puedo cambiar yo los ajustes de sampling?
Sí. Se ajustan por personaje temperature, top_p, top_k, min_p y las penalizaciones, cada uno con su interruptor de envío, así que un modelo que rechaza un parámetro simplemente no lo recibe. Los presets se exportan e importan como JSON.
¿Elijo modelo al crear un personaje?
Puedes, pero no hace falta. Cada personaje nuevo funciona con Standard hasta que lo cambies, y puedes cambiarlo en cualquier momento de cualquier conversación.
Crea un personaje en Telegram →

Sigue leyendo