Casi todas estas palabras llegaron de artículos de investigación y nunca se tradujeron. Con saber seis de ellas, un chat que se porta raro por arte de magia se convierte en un problema que puedes localizar.
Las dos que conviene aprender primero son ventana de contexto y memoria persistente, porque casi toda queja que empieza con «el personaje se ha olvidado» se reduce a confundirlas.
El personaje en sí
Persona: la capa de identidad del personaje, con nombre, voz, actitud, historia y manías. Es lo que se le pide al modelo que encarne en cada respuesta, sin excepción.
Prompt de sistema: el bloque de instrucciones oculto que recibe el modelo antes de generar nada. Aquí contiene la persona, las reglas de la escena activa y el fragmento de memoria de quien está leyendo.
Ficha de personaje: un paquete portátil con persona, mensaje inicial, modelo por defecto y parámetros de sampling. Existen varios formatos estándar de la comunidad y son la forma en que los personajes se mueven entre plataformas.
La memoria, y aquello que se confunde con ella
Ventana de contexto: la cantidad máxima de texto que un modelo puede tener presente para una respuesta. Las ventanas grandes abarcan más conversación reciente y cuestan más por llamada. Es un límite, no un almacén: cuando la conversación lo supera, la parte más antigua simplemente se cae.
Memoria persistente: los datos que un personaje conserva sobre ti entre sesiones. Es un mecanismo completamente distinto: curado, editable y metido en el contexto en cada respuesta. Aquí es por personaje, por tema y por persona, y del todo visible para ti.
Esta es la distinción que resuelve casi todas las quejas. Que un personaje olvide algo de hace una hora es un efecto de la ventana de contexto. Que olvide el nombre de tu hermana es un problema del registro de memoria, y si el dato no se escribió nunca, ningún modelo lo recordará bien.
Token: la unidad atómica que un modelo lee y escribe, más o menos cuatro caracteres de inglés. Las ventanas de contexto se miden en tokens, y por eso un límite que suena enorme se llena antes de lo esperado.
Dirigir una conversación
Rama, o bifurcación: un punto de divergencia. Bifurcar desde una respuesta crea un hilo alternativo que crece al lado del original, y se conservan los dos. Es lo que hace que probar otra dirección salga gratis en vez de destructivo.
Regenerar: pedir otra versión de la última respuesta sin tocar nada más. Mismo contexto, respuesta nueva.
Los mandos
Temperatura: lo predecibles que son las respuestas. Más baja es más estable, más alta es más sorprendente. Un personaje que se siente plano suele ser un problema de temperatura y no de modelo.
top_p, top_k, min_p: restricciones sobre qué palabras candidatas llega siquiera a considerar el modelo. Útiles para afinar el registro: prudente, expresivo, escueto, verboso.
Penalización de repetición: desincentiva reutilizar frases. Es el arreglo para un personaje que suelta su frase favorita cada cuarta respuesta.
La fontanería
Enrutador de modelos: la infraestructura que elige un modelo para una escena dentro de un conjunto y conmuta en silencio cuando uno se degrada.
Failover y cortacircuitos: el enrutador cortando un proveedor que se degrada antes de que pueda envenenar una conversación con esperas o negativas, y mandando el tráfico a uno sano. Cuando funciona no te enteras, que es justo el objetivo.
Por los bordes
Telegram Stars: la unidad de micropago integrada en Telegram, que se compra dentro de Telegram y se gasta en mejoras. Para la recarga en sí no hace falta tarjeta.
Enlace de invitación: una URL con atribución rastreada que abre un chat con el personaje de un creador. Las Stars que gasta quien llega por ahí dan al creador una parte.
Tema: un hilo de foro dedicado dentro de Telegram, usado para dar a cada personaje su propia sala con su historial y su tira de mensajes fijados.
Verificación de edad: el paso de comprobación dentro del bot antes de poder activar el rol adulto. La web pública es apta para todos los públicos; el modo adulto es voluntario tras la verificación, y los límites duros se quedan igualmente.
RTL: escritura de derecha a izquierda, usada en árabe, hebreo y persa. Los elementos de la interfaz se reflejan en vez de quedarse como texto alineado a la izquierda dentro de un idioma alineado a la derecha.