Vocabulário

Os termos do roleplay com IA, explicados sem enrolação

Persona, prompt de sistema, janela de contexto, memória persistente, ramificação, temperatura. O que cada termo quer dizer de fato, e quais importam quando algo dá errado.

Talaforge › Os termos do roleplay com IA, explicados sem enrolação

Quase todas essas palavras vieram de artigos de pesquisa e nunca foram traduzidas. Conhecer seis delas transforma um chat que se comporta mal misteriosamente num problema que você consegue localizar.

As duas que vale aprender primeiro são janela de contexto e memória persistente, porque quase toda reclamação que começa com «o personagem esqueceu» é confusão entre as duas.

O personagem em si

Persona — a camada de identidade do personagem: nome, voz, atitude, história, manias. É o que se pede ao modelo encarnar em cada resposta, sem exceção.

Prompt de sistema — o bloco oculto de instruções que o modelo recebe antes de gerar qualquer coisa. Aqui ele carrega a persona, as regras da cena ativa e o trecho de memória daquele leitor específico.

Ficha de personagem — um pacote portátil com persona, mensagem de abertura, modelo padrão e parâmetros de sampling. Existem vários formatos comunitários e é assim que personagens se mudam de uma plataforma para outra.

Memória, e a coisa que confundem com ela

Janela de contexto — a quantidade máxima de texto que um modelo consegue manter em vista para uma resposta. Janelas maiores alcançam mais da conversa recente e custam mais por chamada. É um limite, não um depósito: quando a conversa passa dele, a parte mais antiga simplesmente cai fora.

Memória persistente — os fatos que um personagem guarda sobre você entre sessões. É um mecanismo completamente diferente: curado, editável e injetado no contexto a cada resposta. Aqui é por personagem, por tópico, por leitor, e totalmente visível para você.

É essa distinção que resolve a maioria das reclamações. Um personagem esquecer algo de uma hora atrás é efeito da janela de contexto. Um personagem esquecer o nome da sua irmã é problema de registro de memória — e se o fato nunca foi escrito, nenhum modelo vai lembrar dele corretamente.

Token — a unidade atômica que um modelo lê e escreve, mais ou menos quatro caracteres de inglês. Janelas de contexto são medidas em tokens, e é por isso que um limite que soa enorme enche mais rápido do que o esperado.

Conduzir uma conversa

Ramo, ou ramificação — um ponto de divergência. Ramificar a partir de uma resposta cria uma linha alternativa que cresce ao lado da original, e as duas ficam guardadas. É o que faz tentar outra direção sair de graça em vez de destrutivo.

Regenerar — pedir outra versão da última resposta sem mexer em mais nada. Mesmo contexto, resposta nova.

Os controles

Temperatura — o quanto as respostas são previsíveis. Mais baixa é mais estável, mais alta é mais surpreendente. Um personagem que parece chapado costuma ser problema de temperatura, e não de modelo.

top_p, top_k, min_p — restrições sobre quais palavras candidatas o modelo chega a considerar. Úteis para ajustar registro: cauteloso, expressivo, seco, prolixo.

Penalidade de repetição — desestimula reaproveitar frases. É a correção para um personagem que solta a frase favorita a cada quarta resposta.

O encanamento

Roteador de modelos — a infraestrutura que escolhe um modelo para uma cena dentro de um conjunto e troca em silêncio quando um deles degrada.

Failover e circuit breaker — o roteador cortando um provedor que está degradando antes que ele envenene a conversa com esperas ou recusas, e mandando o tráfego para um saudável. Quando funciona você nunca percebe, que é justamente o ponto.

Nas bordas

Telegram Stars — a unidade de micropagamento embutida no Telegram, comprada dentro do Telegram e gasta em melhorias. Para a recarga em si não é preciso cartão.

Link de indicação — uma URL com atribuição rastreada que abre uma conversa com o personagem de um criador. As Stars gastas por quem chega por ele rendem uma parte ao criador.

Tópico — uma linha de fórum dedicada dentro do Telegram, usada para dar a cada personagem uma sala própria, com histórico e faixa de fixados próprios.

Verificação de idade — o passo de conferência dentro do bot antes de o roleplay adulto poder ser ativado. O site público não tem conteúdo adulto; o modo adulto é voluntário depois da verificação, e os limites rígidos continuam de pé.

RTL — escrita da direita para a esquerda, usada em árabe, hebraico e persa. Os elementos de interface são espelhados, em vez de ficarem como texto alinhado à esquerda num idioma alinhado à direita.

Qual é a diferença entre janela de contexto e memória?
A janela de contexto é quanto texto um modelo consegue manter em vista para uma única resposta — um limite, medido em tokens, do qual a conversa mais antiga cai fora. A memória persistente é um conjunto curado e editável de fatos guardados sobre você e injetados em toda resposta. A maioria das reclamações de «esqueceu uma coisa» é a primeira; a maioria das de «esqueceu de mim» é a segunda.
O que é um prompt de sistema no roleplay com IA?
O bloco oculto de instruções que o modelo recebe antes de escrever qualquer coisa. Ele carrega a persona do personagem, as regras da cena atual e o trecho de memória sobre você especificamente — que é por isso que o mesmo personagem pode se comportar de forma diferente com dois leitores.
O que é uma ficha de personagem?
Um pacote portátil contendo persona, mensagem de abertura, modelo padrão e parâmetros de sampling. Existem vários formatos comunitários, e é assim que um personagem escrito numa plataforma pode ser importado em outra.
O que a temperatura faz de fato?
Ela controla o quanto a próxima palavra é previsível. Valores baixos deixam as respostas mais estáveis e mais repetitivas; valores altos as deixam mais surpreendentes e menos controladas. Um personagem que soa chapado está muito mais vezes ajustado baixo demais do que no modelo errado.
O que significa ramificar uma conversa?
Sair de uma resposta para uma linha alternativa mantendo a original. As duas continuam existindo e crescendo em separado, então tentar outra direção não custa nada.
O que é um token?
A unidade que um modelo lê e escreve — mais ou menos quatro caracteres de texto em inglês. Limites de contexto são contados em tokens, então uma janela que parece grande em números guarda menos conversa do que aparenta.
O que é um roteador de modelos?
Infraestrutura que seleciona qual modelo atende uma cena e se afasta de um que começa a falhar, antes que esperas ou recusas cheguem à conversa. Funcionando direito, ele é invisível.
Crie um personagem no Telegram →

Continue lendo