De flesta av de här orden kom från forskningsartiklar och blev aldrig översatta. Att kunna sex av dem förvandlar en chatt som mystiskt beter sig illa till ett problem du kan lokalisera.
De två värda att lära sig först är kontextfönster och beständigt minne, för nästan varje klagomål som börjar med karaktären glömde kokar ner till att blanda ihop dem.
Själva karaktären
Persona — karaktärens identitetslager: namn, röst, attityd, historia, manér. Det är detta modellen ombeds gestalta i varje enskilt svar.
Systemprompt — det dolda instruktionsblocket modellen får innan den genererar något. Här rymmer det personan, de aktiva scenreglerna och minnesutdraget för just den här läsaren.
Karaktärskort — ett portabelt paket av persona, öppningsmeddelande, standardmodell och samplingsparametrar. Flera community-standardformat finns och är hur karaktärer flyttar mellan plattformar.
Minnet, och det folk förväxlar med det
Kontextfönster — den maximala mängd text en modell kan hålla i huvudet för ett svar. Större fönster refererar mer av den senaste konversationen och kostar mer per anrop. Det är en gräns, inte ett lager: när en konversation löper förbi den faller den äldsta delen helt enkelt ur.
Beständigt minne — fakta en karaktär behåller om dig mellan sessioner. Det är en helt annan mekanism: kurerad, redigerbar och insprutad i kontexten vid varje svar. Här är det per karaktär, per ämne, per läsare, och helt synligt för dig.
Det är den distinktionen som löser de flesta klagomål. En karaktär som glömmer något från för en timme sedan är en kontextfönstereffekt. En karaktär som glömmer vad din syster heter är ett minnesproblem — och om uppgiften aldrig skrevs ner kommer ingen modell att minnas den korrekt.
Token — den minsta enhet en modell läser och skriver, ungefär fyra tecken engelska. Kontextfönster mäts i tokens, vilket är varför en gräns som låter enorm fylls snabbare än väntat.
Att styra en konversation
Gren, eller förgrening — en divergenspunkt. Att förgrena från ett svar skapar en alternativ tråd som växer vid sidan av originalet, och båda behålls. Det är detta som gör det gratis snarare än destruktivt att prova en annan riktning.
Generera om — att be om en annan version av det senaste svaret utan att rubba något annat. Samma kontext, nytt svar.
Rattarna
Temperature — hur förutsägbara svaren är. Lägre är stadigare, högre mer överraskande. En karaktär som känns platt är ofta ett temperature-problem snarare än ett modellproblem.
top_p, top_k, min_p — begränsningar för vilka kandidatord modellen alls överväger. Användbara för att stämma tonläget: försiktig, uttrycksfull, kortfattad, mångordig.
Repetitionsstraff — avskräcker från att återanvända fraser. Det är fixen för en karaktär som säger sin favoritreplik vart fjärde svar.
Rörsystemet
Modellrouter — infrastrukturen som väljer en modell för en scen ur en pool och tyst kopplar om när en börjar svikta.
Failover och kretsbrytare — routern som kopplar bort en sviktande leverantör innan den hinner förgifta en konversation med timeouts eller vägran, och skickar trafiken till en frisk i stället. När det fungerar märker du det aldrig, vilket är poängen.
Runt kanterna
Telegram Stars — Telegrams inbyggda mikrobetalningsenhet, köpt inne i Telegram och spenderad på uppgraderingar. Inget kort behövs för själva påfyllningen.
Delningslänk — en attributionsspårad URL som öppnar en chatt med en skapares karaktär. Stars som spenderas av dem som kommer via den ger skaparen en andel.
Ämne — en dedikerad forumtråd i Telegram, använd för att ge varje karaktär ett eget rum med egen historik och egen fästremsa.
Ålderskontroll — verifieringssteget inne i boten innan vuxenrollspel kan aktiveras. Den publika webbplatsen är SFW; vuxenläget är opt-in efter kontrollen, och hårda gränser gäller oavsett.
RTL — höger-till-vänster-skrift, använd för arabiska, hebreiska och persiska. Gränssnittselement speglas i stället för att vara vänsterjusterad text i ett högerjusterat språk.