Ordförråd

AI-rollspelstermer, enkelt förklarade

Persona, systemprompt, kontextfönster, beständigt minne, förgrening, temperature. Vad varje term faktiskt betyder, och vilka som spelar roll när något går fel.

Talaforge › AI-rollspelstermer, enkelt förklarade

De flesta av de här orden kom från forskningsartiklar och blev aldrig översatta. Att kunna sex av dem förvandlar en chatt som mystiskt beter sig illa till ett problem du kan lokalisera.

De två värda att lära sig först är kontextfönster och beständigt minne, för nästan varje klagomål som börjar med karaktären glömde kokar ner till att blanda ihop dem.

Själva karaktären

Persona — karaktärens identitetslager: namn, röst, attityd, historia, manér. Det är detta modellen ombeds gestalta i varje enskilt svar.

Systemprompt — det dolda instruktionsblocket modellen får innan den genererar något. Här rymmer det personan, de aktiva scenreglerna och minnesutdraget för just den här läsaren.

Karaktärskort — ett portabelt paket av persona, öppningsmeddelande, standardmodell och samplingsparametrar. Flera community-standardformat finns och är hur karaktärer flyttar mellan plattformar.

Minnet, och det folk förväxlar med det

Kontextfönster — den maximala mängd text en modell kan hålla i huvudet för ett svar. Större fönster refererar mer av den senaste konversationen och kostar mer per anrop. Det är en gräns, inte ett lager: när en konversation löper förbi den faller den äldsta delen helt enkelt ur.

Beständigt minne — fakta en karaktär behåller om dig mellan sessioner. Det är en helt annan mekanism: kurerad, redigerbar och insprutad i kontexten vid varje svar. Här är det per karaktär, per ämne, per läsare, och helt synligt för dig.

Det är den distinktionen som löser de flesta klagomål. En karaktär som glömmer något från för en timme sedan är en kontextfönstereffekt. En karaktär som glömmer vad din syster heter är ett minnesproblem — och om uppgiften aldrig skrevs ner kommer ingen modell att minnas den korrekt.

Token — den minsta enhet en modell läser och skriver, ungefär fyra tecken engelska. Kontextfönster mäts i tokens, vilket är varför en gräns som låter enorm fylls snabbare än väntat.

Att styra en konversation

Gren, eller förgrening — en divergenspunkt. Att förgrena från ett svar skapar en alternativ tråd som växer vid sidan av originalet, och båda behålls. Det är detta som gör det gratis snarare än destruktivt att prova en annan riktning.

Generera om — att be om en annan version av det senaste svaret utan att rubba något annat. Samma kontext, nytt svar.

Rattarna

Temperature — hur förutsägbara svaren är. Lägre är stadigare, högre mer överraskande. En karaktär som känns platt är ofta ett temperature-problem snarare än ett modellproblem.

top_p, top_k, min_p — begränsningar för vilka kandidatord modellen alls överväger. Användbara för att stämma tonläget: försiktig, uttrycksfull, kortfattad, mångordig.

Repetitionsstraff — avskräcker från att återanvända fraser. Det är fixen för en karaktär som säger sin favoritreplik vart fjärde svar.

Rörsystemet

Modellrouter — infrastrukturen som väljer en modell för en scen ur en pool och tyst kopplar om när en börjar svikta.

Failover och kretsbrytare — routern som kopplar bort en sviktande leverantör innan den hinner förgifta en konversation med timeouts eller vägran, och skickar trafiken till en frisk i stället. När det fungerar märker du det aldrig, vilket är poängen.

Runt kanterna

Telegram Stars — Telegrams inbyggda mikrobetalningsenhet, köpt inne i Telegram och spenderad på uppgraderingar. Inget kort behövs för själva påfyllningen.

Delningslänk — en attributionsspårad URL som öppnar en chatt med en skapares karaktär. Stars som spenderas av dem som kommer via den ger skaparen en andel.

Ämne — en dedikerad forumtråd i Telegram, använd för att ge varje karaktär ett eget rum med egen historik och egen fästremsa.

Ålderskontroll — verifieringssteget inne i boten innan vuxenrollspel kan aktiveras. Den publika webbplatsen är SFW; vuxenläget är opt-in efter kontrollen, och hårda gränser gäller oavsett.

RTL — höger-till-vänster-skrift, använd för arabiska, hebreiska och persiska. Gränssnittselement speglas i stället för att vara vänsterjusterad text i ett högerjusterat språk.

Vad är skillnaden mellan kontextfönster och minne?
Kontextfönstret är hur mycket text en modell kan hålla i huvudet för ett enda svar — en gräns, mätt i tokens, som äldre konversation faller ur. Beständigt minne är en kurerad, redigerbar uppsättning fakta som sparas om dig och sprutas in i varje svar. De flesta glömde-något-klagomål är det första; de flesta glömde-mig-klagomål är det andra.
Vad är en systemprompt i AI-rollspel?
Det dolda instruktionsblocket modellen får innan den skriver något. Det bär karaktärens persona, de aktuella scenreglerna och minnesutdraget för just dig — vilket är varför samma karaktär kan bete sig olika med två olika läsare.
Vad är ett karaktärskort?
Ett portabelt paket med en persona, ett öppningsmeddelande, en standardmodell och samplingsparametrar. Flera community-standardformat finns, vilket är hur en karaktär skriven på en plattform kan importeras till en annan.
Vad gör temperature egentligen?
Den styr hur förutsägbart nästa ord är. Lägre värden gör svaren stadigare och mer repetitiva; högre gör dem mer överraskande och mindre kontrollerade. En karaktär som läses platt är väldigt ofta inställd för lågt snarare än på fel modell.
Vad betyder det att förgrena en konversation?
Att dela från ett svar in i en alternativ tråd medan originalet behålls. Båda fortsätter existera och växa separat, så att prova en annan riktning kostar ingenting.
Vad är en token?
Enheten en modell läser och skriver — ungefär fyra tecken engelsk text. Kontextgränser räknas i tokens, så ett fönster som låter stort i siffror rymmer mindre konversation än det verkar.
Vad är en modellrouter?
Infrastruktur som väljer vilken modell som betjänar en scen och kopplar bort en som börjar fallera, innan timeouts eller vägran når konversationen. När den fungerar korrekt är den osynlig.
Skapa en karaktär i Telegram →

Läs vidare