Die meisten dieser Wörter kamen aus Forschungsarbeiten und wurden nie übersetzt. Sechs davon zu kennen macht aus einem Chat, der sich rätselhaft danebenbenimmt, ein Problem, das du verorten kannst.
Die zwei, die du zuerst lernen solltest, sind Kontextfenster und dauerhaftes Gedächtnis — fast jede Beschwerde, die mit „der Charakter hat vergessen“ beginnt, läuft darauf hinaus, die beiden zu verwechseln.
Der Charakter selbst
Persona — die Identitätsschicht des Charakters: Name, Stimme, Haltung, Geschichte, Eigenheiten. Das ist es, was das Modell bei jeder einzelnen Antwort verkörpern soll.
System-Prompt — der versteckte Anweisungsblock, den das Modell erhält, bevor es irgendetwas erzeugt. Hier enthält er die Persona, die aktiven Szenenregeln und den Gedächtnisausschnitt für genau diese Leserin oder diesen Leser.
Charakterkarte — ein portables Bündel aus Persona, Eröffnungsnachricht, Standardmodell und Sampling-Parametern. Es gibt mehrere Community-Standard-Formate, und über sie wandern Charaktere zwischen Plattformen.
Gedächtnis, und das, was man dafür hält
Kontextfenster — die maximale Textmenge, die ein Modell für eine Antwort im Kopf behalten kann. Größere Fenster beziehen mehr vom jüngsten Gespräch ein und kosten mehr pro Aufruf. Es ist eine Grenze, kein Speicher: Läuft ein Gespräch darüber hinaus, fällt der älteste Teil einfach heraus.
Dauerhaftes Gedächtnis — Fakten, die ein Charakter über Sitzungen hinweg über dich behält. Das ist ein völlig anderer Mechanismus: kuratiert, bearbeitbar und bei jeder Antwort in den Kontext eingespeist. Hier ist es pro Charakter, pro Thema, pro Leserin oder Leser — und vollständig für dich sichtbar.
Das ist die Unterscheidung, die die meisten Beschwerden auflöst. Dass ein Charakter etwas von vor einer Stunde vergisst, ist ein Kontextfenster-Effekt. Dass ein Charakter den Namen deiner Schwester vergisst, ist ein Gedächtniseintrag-Problem — und wenn der Fakt nie aufgeschrieben wurde, wird ihn kein Modell korrekt abrufen.
Token — die atomare Einheit, die ein Modell liest und schreibt, grob vier Zeichen englischen Texts. Kontextfenster werden in Tokens gemessen, weshalb sich eine Grenze, die riesig klingt, schneller füllt als erwartet.
Ein Gespräch lenken
Verzweigen, oder Forken — ein Abzweigungspunkt. Von einer Antwort zu forken erzeugt einen alternativen Thread, der neben dem Original wächst, und beide bleiben erhalten. Das macht das Ausprobieren einer anderen Richtung kostenlos statt zerstörerisch.
Regenerieren — eine weitere Version der letzten Antwort anfordern, ohne irgendetwas anderes anzurühren. Gleicher Kontext, neue Antwort.
Die Regler
Temperature — wie vorhersehbar die Antworten sind. Niedriger ist stetiger, höher überraschender. Ein Charakter, der flach wirkt, ist oft ein Temperature-Problem und kein Modellproblem.
top_p, top_k, min_p — Beschränkungen dafür, welche Kandidaten für das nächste Wort das Modell überhaupt in Betracht zieht. Nützlich zum Abstimmen des Registers: vorsichtig, ausdrucksstark, knapp, wortreich.
Repetition Penalty — bestraft das Wiederverwenden von Phrasen. Das ist die Lösung für einen Charakter, der jede vierte Antwort seinen Lieblingssatz sagt.
Die Technik dahinter
Modell-Router — die Infrastruktur, die für eine Szene ein Modell aus einem Pool wählt und still auf ein anderes ausweicht, wenn eines schwächelt.
Failover und Circuit Breaker — der Router, der einen schwächelnden Anbieter abklemmt, bevor er ein Gespräch mit Timeouts oder Verweigerungen vergiften kann, und den Verkehr stattdessen zu einem gesunden schickt. Wenn das funktioniert, merkst du es nie — genau das ist der Punkt.
Am Rand
Telegram Stars — Telegrams eingebaute Mikrozahlungseinheit, in Telegram gekauft und für Upgrades ausgegeben. Für das Aufladen selbst ist keine Karte nötig.
Teilen-Link — eine URL mit Zuordnungsverfolgung, die einen Chat mit dem Charakter eines Creators öffnet. Stars, die von darüber ankommenden Leuten ausgegeben werden, bringen dem Creator einen Anteil.
Topic — ein eigener Forum-Thread in Telegram, genutzt, um jedem Charakter einen eigenen Raum mit eigenem Verlauf und eigener Pin-Leiste zu geben.
Altersprüfung — der Verifizierungsschritt im Bot, bevor reifes Rollenspiel aktiviert werden kann. Die öffentliche Website ist SFW; der reife Modus ist Opt-in nach der Prüfung, und harte Grenzen bleiben unabhängig davon bestehen.
RTL — Schrift von rechts nach links, verwendet für Arabisch, Hebräisch und Persisch. Oberflächenelemente werden gespiegelt, statt linksbündiger Text in einer rechtsbündigen Sprache zu sein.