Quase todas essas palavras vieram de artigos de pesquisa e nunca foram traduzidas. Conhecer seis delas transforma um chat que se comporta mal misteriosamente num problema que você consegue localizar.
As duas que vale aprender primeiro são janela de contexto e memória persistente, porque quase toda reclamação que começa com «o personagem esqueceu» é confusão entre as duas.
O personagem em si
Persona — a camada de identidade do personagem: nome, voz, atitude, história, manias. É o que se pede ao modelo encarnar em cada resposta, sem exceção.
Prompt de sistema — o bloco oculto de instruções que o modelo recebe antes de gerar qualquer coisa. Aqui ele carrega a persona, as regras da cena ativa e o trecho de memória daquele leitor específico.
Ficha de personagem — um pacote portátil com persona, mensagem de abertura, modelo padrão e parâmetros de sampling. Existem vários formatos comunitários e é assim que personagens se mudam de uma plataforma para outra.
Memória, e a coisa que confundem com ela
Janela de contexto — a quantidade máxima de texto que um modelo consegue manter em vista para uma resposta. Janelas maiores alcançam mais da conversa recente e custam mais por chamada. É um limite, não um depósito: quando a conversa passa dele, a parte mais antiga simplesmente cai fora.
Memória persistente — os fatos que um personagem guarda sobre você entre sessões. É um mecanismo completamente diferente: curado, editável e injetado no contexto a cada resposta. Aqui é por personagem, por tópico, por leitor, e totalmente visível para você.
É essa distinção que resolve a maioria das reclamações. Um personagem esquecer algo de uma hora atrás é efeito da janela de contexto. Um personagem esquecer o nome da sua irmã é problema de registro de memória — e se o fato nunca foi escrito, nenhum modelo vai lembrar dele corretamente.
Token — a unidade atômica que um modelo lê e escreve, mais ou menos quatro caracteres de inglês. Janelas de contexto são medidas em tokens, e é por isso que um limite que soa enorme enche mais rápido do que o esperado.
Conduzir uma conversa
Ramo, ou ramificação — um ponto de divergência. Ramificar a partir de uma resposta cria uma linha alternativa que cresce ao lado da original, e as duas ficam guardadas. É o que faz tentar outra direção sair de graça em vez de destrutivo.
Regenerar — pedir outra versão da última resposta sem mexer em mais nada. Mesmo contexto, resposta nova.
Os controles
Temperatura — o quanto as respostas são previsíveis. Mais baixa é mais estável, mais alta é mais surpreendente. Um personagem que parece chapado costuma ser problema de temperatura, e não de modelo.
top_p, top_k, min_p — restrições sobre quais palavras candidatas o modelo chega a considerar. Úteis para ajustar registro: cauteloso, expressivo, seco, prolixo.
Penalidade de repetição — desestimula reaproveitar frases. É a correção para um personagem que solta a frase favorita a cada quarta resposta.
O encanamento
Roteador de modelos — a infraestrutura que escolhe um modelo para uma cena dentro de um conjunto e troca em silêncio quando um deles degrada.
Failover e circuit breaker — o roteador cortando um provedor que está degradando antes que ele envenene a conversa com esperas ou recusas, e mandando o tráfego para um saudável. Quando funciona você nunca percebe, que é justamente o ponto.
Nas bordas
Telegram Stars — a unidade de micropagamento embutida no Telegram, comprada dentro do Telegram e gasta em melhorias. Para a recarga em si não é preciso cartão.
Link de indicação — uma URL com atribuição rastreada que abre uma conversa com o personagem de um criador. As Stars gastas por quem chega por ele rendem uma parte ao criador.
Tópico — uma linha de fórum dedicada dentro do Telegram, usada para dar a cada personagem uma sala própria, com histórico e faixa de fixados próprios.
Verificação de idade — o passo de conferência dentro do bot antes de o roleplay adulto poder ser ativado. O site público não tem conteúdo adulto; o modo adulto é voluntário depois da verificação, e os limites rígidos continuam de pé.
RTL — escrita da direita para a esquerda, usada em árabe, hebraico e persa. Os elementos de interface são espelhados, em vez de ficarem como texto alinhado à esquerda num idioma alinhado à direita.