Vokabular

KI-Rollenspiel-Begriffe, einfach erklärt

Persona, System-Prompt, Kontextfenster, dauerhaftes Gedächtnis, Forken, Temperature. Was jeder Begriff wirklich bedeutet — und welche zählen, wenn etwas schiefgeht.

Talaforge › KI-Rollenspiel-Begriffe, einfach erklärt

Die meisten dieser Wörter kamen aus Forschungsarbeiten und wurden nie übersetzt. Sechs davon zu kennen macht aus einem Chat, der sich rätselhaft danebenbenimmt, ein Problem, das du verorten kannst.

Die zwei, die du zuerst lernen solltest, sind Kontextfenster und dauerhaftes Gedächtnis — fast jede Beschwerde, die mit „der Charakter hat vergessen“ beginnt, läuft darauf hinaus, die beiden zu verwechseln.

Der Charakter selbst

Persona — die Identitätsschicht des Charakters: Name, Stimme, Haltung, Geschichte, Eigenheiten. Das ist es, was das Modell bei jeder einzelnen Antwort verkörpern soll.

System-Prompt — der versteckte Anweisungsblock, den das Modell erhält, bevor es irgendetwas erzeugt. Hier enthält er die Persona, die aktiven Szenenregeln und den Gedächtnisausschnitt für genau diese Leserin oder diesen Leser.

Charakterkarte — ein portables Bündel aus Persona, Eröffnungsnachricht, Standardmodell und Sampling-Parametern. Es gibt mehrere Community-Standard-Formate, und über sie wandern Charaktere zwischen Plattformen.

Gedächtnis, und das, was man dafür hält

Kontextfenster — die maximale Textmenge, die ein Modell für eine Antwort im Kopf behalten kann. Größere Fenster beziehen mehr vom jüngsten Gespräch ein und kosten mehr pro Aufruf. Es ist eine Grenze, kein Speicher: Läuft ein Gespräch darüber hinaus, fällt der älteste Teil einfach heraus.

Dauerhaftes Gedächtnis — Fakten, die ein Charakter über Sitzungen hinweg über dich behält. Das ist ein völlig anderer Mechanismus: kuratiert, bearbeitbar und bei jeder Antwort in den Kontext eingespeist. Hier ist es pro Charakter, pro Thema, pro Leserin oder Leser — und vollständig für dich sichtbar.

Das ist die Unterscheidung, die die meisten Beschwerden auflöst. Dass ein Charakter etwas von vor einer Stunde vergisst, ist ein Kontextfenster-Effekt. Dass ein Charakter den Namen deiner Schwester vergisst, ist ein Gedächtniseintrag-Problem — und wenn der Fakt nie aufgeschrieben wurde, wird ihn kein Modell korrekt abrufen.

Token — die atomare Einheit, die ein Modell liest und schreibt, grob vier Zeichen englischen Texts. Kontextfenster werden in Tokens gemessen, weshalb sich eine Grenze, die riesig klingt, schneller füllt als erwartet.

Ein Gespräch lenken

Verzweigen, oder Forken — ein Abzweigungspunkt. Von einer Antwort zu forken erzeugt einen alternativen Thread, der neben dem Original wächst, und beide bleiben erhalten. Das macht das Ausprobieren einer anderen Richtung kostenlos statt zerstörerisch.

Regenerieren — eine weitere Version der letzten Antwort anfordern, ohne irgendetwas anderes anzurühren. Gleicher Kontext, neue Antwort.

Die Regler

Temperature — wie vorhersehbar die Antworten sind. Niedriger ist stetiger, höher überraschender. Ein Charakter, der flach wirkt, ist oft ein Temperature-Problem und kein Modellproblem.

top_p, top_k, min_p — Beschränkungen dafür, welche Kandidaten für das nächste Wort das Modell überhaupt in Betracht zieht. Nützlich zum Abstimmen des Registers: vorsichtig, ausdrucksstark, knapp, wortreich.

Repetition Penalty — bestraft das Wiederverwenden von Phrasen. Das ist die Lösung für einen Charakter, der jede vierte Antwort seinen Lieblingssatz sagt.

Die Technik dahinter

Modell-Router — die Infrastruktur, die für eine Szene ein Modell aus einem Pool wählt und still auf ein anderes ausweicht, wenn eines schwächelt.

Failover und Circuit Breaker — der Router, der einen schwächelnden Anbieter abklemmt, bevor er ein Gespräch mit Timeouts oder Verweigerungen vergiften kann, und den Verkehr stattdessen zu einem gesunden schickt. Wenn das funktioniert, merkst du es nie — genau das ist der Punkt.

Am Rand

Telegram Stars — Telegrams eingebaute Mikrozahlungseinheit, in Telegram gekauft und für Upgrades ausgegeben. Für das Aufladen selbst ist keine Karte nötig.

Teilen-Link — eine URL mit Zuordnungsverfolgung, die einen Chat mit dem Charakter eines Creators öffnet. Stars, die von darüber ankommenden Leuten ausgegeben werden, bringen dem Creator einen Anteil.

Topic — ein eigener Forum-Thread in Telegram, genutzt, um jedem Charakter einen eigenen Raum mit eigenem Verlauf und eigener Pin-Leiste zu geben.

Altersprüfung — der Verifizierungsschritt im Bot, bevor reifes Rollenspiel aktiviert werden kann. Die öffentliche Website ist SFW; der reife Modus ist Opt-in nach der Prüfung, und harte Grenzen bleiben unabhängig davon bestehen.

RTL — Schrift von rechts nach links, verwendet für Arabisch, Hebräisch und Persisch. Oberflächenelemente werden gespiegelt, statt linksbündiger Text in einer rechtsbündigen Sprache zu sein.

Was ist der Unterschied zwischen Kontextfenster und Gedächtnis?
Das Kontextfenster ist, wie viel Text ein Modell für eine einzelne Antwort im Kopf behalten kann — eine in Tokens gemessene Grenze, aus der älteres Gespräch herausfällt. Dauerhaftes Gedächtnis ist ein kuratierter, bearbeitbarer Satz Fakten über dich, der in jede Antwort eingespeist wird. Die meisten „etwas vergessen“-Beschwerden sind das Erste; die meisten „mich vergessen“-Beschwerden das Zweite.
Was ist ein System-Prompt im KI-Rollenspiel?
Der versteckte Anweisungsblock, den das Modell erhält, bevor es irgendetwas schreibt. Er trägt die Persona des Charakters, die aktuellen Szenenregeln und den Gedächtnisausschnitt speziell für dich — deshalb kann sich derselbe Charakter bei zwei verschiedenen Personen unterschiedlich verhalten.
Was ist eine Charakterkarte?
Ein portables Bündel mit Persona, Eröffnungsnachricht, Standardmodell und Sampling-Parametern. Es gibt mehrere Community-Standard-Formate — so lässt sich ein auf einer Plattform geschriebener Charakter in eine andere importieren.
Was macht Temperature eigentlich?
Sie steuert, wie vorhersehbar das nächste Wort ist. Niedrigere Werte machen Antworten stetiger und wiederholungsanfälliger; höhere machen sie überraschender und weniger kontrolliert. Ein Charakter, der flach liest, ist sehr oft zu niedrig eingestellt statt auf dem falschen Modell.
Was bedeutet es, ein Gespräch zu forken?
Von einer Antwort in einen alternativen Thread abzuzweigen und das Original zu behalten. Beide existieren weiter und wachsen getrennt, eine andere Richtung auszuprobieren kostet also nichts.
Was ist ein Token?
Die Einheit, die ein Modell liest und schreibt — grob vier Zeichen englischen Texts. Kontextgrenzen werden in Tokens gezählt, ein Fenster, das nach großen Zahlen klingt, fasst also weniger Gespräch, als es scheint.
Was ist ein Modell-Router?
Infrastruktur, die auswählt, welches Modell eine Szene bedient, und von einem wegschaltet, das zu versagen beginnt — bevor Timeouts oder Verweigerungen das Gespräch erreichen. Funktioniert er richtig, ist er unsichtbar.
Charakter in Telegram erstellen →

Weiterlesen