Vocabulario

Los términos del rol con IA, explicados claros

Persona, prompt de sistema, ventana de contexto, memoria persistente, bifurcación, temperatura. Qué significa de verdad cada término y cuáles importan cuando algo va mal.

Talaforge › Los términos del rol con IA, explicados claros

Casi todas estas palabras llegaron de artículos de investigación y nunca se tradujeron. Con saber seis de ellas, un chat que se porta raro por arte de magia se convierte en un problema que puedes localizar.

Las dos que conviene aprender primero son ventana de contexto y memoria persistente, porque casi toda queja que empieza con «el personaje se ha olvidado» se reduce a confundirlas.

El personaje en sí

Persona: la capa de identidad del personaje, con nombre, voz, actitud, historia y manías. Es lo que se le pide al modelo que encarne en cada respuesta, sin excepción.

Prompt de sistema: el bloque de instrucciones oculto que recibe el modelo antes de generar nada. Aquí contiene la persona, las reglas de la escena activa y el fragmento de memoria de quien está leyendo.

Ficha de personaje: un paquete portátil con persona, mensaje inicial, modelo por defecto y parámetros de sampling. Existen varios formatos estándar de la comunidad y son la forma en que los personajes se mueven entre plataformas.

La memoria, y aquello que se confunde con ella

Ventana de contexto: la cantidad máxima de texto que un modelo puede tener presente para una respuesta. Las ventanas grandes abarcan más conversación reciente y cuestan más por llamada. Es un límite, no un almacén: cuando la conversación lo supera, la parte más antigua simplemente se cae.

Memoria persistente: los datos que un personaje conserva sobre ti entre sesiones. Es un mecanismo completamente distinto: curado, editable y metido en el contexto en cada respuesta. Aquí es por personaje, por tema y por persona, y del todo visible para ti.

Esta es la distinción que resuelve casi todas las quejas. Que un personaje olvide algo de hace una hora es un efecto de la ventana de contexto. Que olvide el nombre de tu hermana es un problema del registro de memoria, y si el dato no se escribió nunca, ningún modelo lo recordará bien.

Token: la unidad atómica que un modelo lee y escribe, más o menos cuatro caracteres de inglés. Las ventanas de contexto se miden en tokens, y por eso un límite que suena enorme se llena antes de lo esperado.

Dirigir una conversación

Rama, o bifurcación: un punto de divergencia. Bifurcar desde una respuesta crea un hilo alternativo que crece al lado del original, y se conservan los dos. Es lo que hace que probar otra dirección salga gratis en vez de destructivo.

Regenerar: pedir otra versión de la última respuesta sin tocar nada más. Mismo contexto, respuesta nueva.

Los mandos

Temperatura: lo predecibles que son las respuestas. Más baja es más estable, más alta es más sorprendente. Un personaje que se siente plano suele ser un problema de temperatura y no de modelo.

top_p, top_k, min_p: restricciones sobre qué palabras candidatas llega siquiera a considerar el modelo. Útiles para afinar el registro: prudente, expresivo, escueto, verboso.

Penalización de repetición: desincentiva reutilizar frases. Es el arreglo para un personaje que suelta su frase favorita cada cuarta respuesta.

La fontanería

Enrutador de modelos: la infraestructura que elige un modelo para una escena dentro de un conjunto y conmuta en silencio cuando uno se degrada.

Failover y cortacircuitos: el enrutador cortando un proveedor que se degrada antes de que pueda envenenar una conversación con esperas o negativas, y mandando el tráfico a uno sano. Cuando funciona no te enteras, que es justo el objetivo.

Por los bordes

Telegram Stars: la unidad de micropago integrada en Telegram, que se compra dentro de Telegram y se gasta en mejoras. Para la recarga en sí no hace falta tarjeta.

Enlace de invitación: una URL con atribución rastreada que abre un chat con el personaje de un creador. Las Stars que gasta quien llega por ahí dan al creador una parte.

Tema: un hilo de foro dedicado dentro de Telegram, usado para dar a cada personaje su propia sala con su historial y su tira de mensajes fijados.

Verificación de edad: el paso de comprobación dentro del bot antes de poder activar el rol adulto. La web pública es apta para todos los públicos; el modo adulto es voluntario tras la verificación, y los límites duros se quedan igualmente.

RTL: escritura de derecha a izquierda, usada en árabe, hebreo y persa. Los elementos de la interfaz se reflejan en vez de quedarse como texto alineado a la izquierda dentro de un idioma alineado a la derecha.

¿Cuál es la diferencia entre ventana de contexto y memoria?
La ventana de contexto es cuánto texto puede tener presente un modelo para una sola respuesta: un límite, medido en tokens, del que se cae la conversación más antigua. La memoria persistente es un conjunto curado y editable de datos que se guarda sobre ti y se mete en cada respuesta. Casi todas las quejas de «se le ha olvidado algo» son lo primero; casi todas las de «se ha olvidado de mí» son lo segundo.
¿Qué es un prompt de sistema en el rol con IA?
El bloque de instrucciones oculto que recibe el modelo antes de escribir nada. Lleva la persona del personaje, las reglas de la escena actual y el fragmento de memoria de ti en concreto, y por eso el mismo personaje puede comportarse distinto con dos lectores distintos.
¿Qué es una ficha de personaje?
Un paquete portátil que contiene una persona, un mensaje inicial, un modelo por defecto y parámetros de sampling. Existen varios formatos estándar de la comunidad, y es así como un personaje escrito en una plataforma se puede importar en otra.
¿Qué hace en realidad la temperatura?
Controla lo predecible que es la siguiente palabra. Los valores bajos dan respuestas más estables y más repetitivas; los altos, más sorprendentes y menos controladas. Un personaje que se lee plano está muy a menudo demasiado bajo, no en el modelo equivocado.
¿Qué significa bifurcar una conversación?
Salir de una respuesta hacia un hilo alternativo conservando el original. Los dos siguen existiendo y creciendo por separado, así que probar otra dirección no cuesta nada.
¿Qué es un token?
La unidad que un modelo lee y escribe, más o menos cuatro caracteres de texto en inglés. Los límites de contexto se cuentan en tokens, así que una ventana que suena grande en números sostiene menos conversación de lo que parece.
¿Qué es un enrutador de modelos?
La infraestructura que elige qué modelo atiende una escena y se aparta de uno que empieza a fallar antes de que las esperas o las negativas lleguen a la conversación. Cuando funciona bien, es invisible.
Crea un personaje en Telegram →

Sigue leyendo