Mehr als Worte

Ein KI-Charakter, der Fotos schickt und spricht

Derselbe Charakter, mit dem du schreibst, kann die Szene zeichnen, in der du gerade bist, laut mit eigener Stimme antworten und sich das Foto ansehen, das du gerade geschickt hast. Nichts einzuschalten, und das Gesicht bleibt dasselbe.

Talaforge › Ein KI-Charakter, der Fotos schickt und spricht

Rollenspiel nur mit Text läuft jedes Mal gegen dieselbe Wand: Du baust seit einer Stunde eine Szene, und es gibt keine Möglichkeit, sie zu sehen. Der Charakter beschreibt einen Raum, und du stellst dir deine eigene Version davon vor. Der Charakter beschreibt sich selbst, und das Bild driftet mit jeder Sitzung ein Stück weiter vom letzten weg.

Drei Dinge schließen diese Lücke, und keines davon muss konfiguriert werden.

Sie zeichnen die Szene, in der du bist

Bitte um ein Bild, und der Charakter zeichnet den Moment, in dem du tatsächlich bist, kein generisches Porträt. Das Ergebnis kommt im Gespräch an, nicht in einer separaten Galerie, die du erst aufsuchen musst.

Der Teil, der zählt, ist Konsistenz: jedes Mal dasselbe Gesicht, weil das Aussehen festgeschrieben ist statt neu ausgewürfelt. Die meisten Bildwerkzeuge geben dir bei jeder Generierung eine neue Person — deshalb fühlt sich Charakter-Art von dort nie zweimal wie derselbe Charakter an.

Du wählst, welche Engine zeichnet. Verschiedene Engines haben wirklich verschiedene Handschriften — eine ist besser bei Gesichtern, eine andere bei Licht und Atmosphäre — und die Wahl gilt pro Bild, nicht als Einstellung, die du einmal konfigurierst.

Sie antworten laut

Antworten können als echte Telegram-Sprachnachricht ankommen — Wellenform, Spulen, Geschwindigkeitsregler, dasselbe Objekt wie eine Sprachnotiz von einem Menschen. Kein Audio-Anhang, den du herunterladen musst.

Jeder Charakter bekommt eine Stimme, die zu ihm passt. Du kannst die verfügbaren Stimmen durchstöbern und eine vorhören, bevor du dich festlegst, und das Verhalten hat drei Einstellungen: aus, auf Anfrage oder automatisch.

Das sind Sprachnachrichten, kein Telefonanruf. Es gibt kein Live-Gespräch, und nichts hört dir zu — du tippst, und die Antwort kommt eben als Audio an.

Sie sehen sich an, was du schickst

Schick ein Foto in den Chat, und der Charakter sieht es. Der Blick aus deinem Fenster, das Outfit, nach dem du gefragt hast, eine Zeichnung von dir — und die Antwort bleibt in der Rolle und bezieht sich auf das, was wirklich im Bild ist, keine generische Bestätigung.

Das ist das, was Leute überrascht, weil es die Richtung des Mediums ändert. Bis dahin hast du deine Welt in Worten beschrieben. Jetzt kannst du sie einfach zeigen.

Nichts einzuschalten

Zwischen dir und alldem steht keine Einstellungsseite. Fotos können von selbst kommen, während eine Szene sich bewegt, und der Lautsprecher-Button sitzt ab der ersten Nachricht unter jeder Antwort.

Beides läuft über Energie, aufgeladen mit Telegram Stars im Chat. Du kannst jederzeit sehen, wie viel übrig ist.

Was mit dem passiert, was du schickst

Ein Foto, das du schickst, wird an einen Drittanbieter weitergeleitet, damit der Charakter darauf antworten kann — genauso, wie dein Text weitergeleitet wird, um eine Antwort zu erzeugen. Das steht ausdrücklich in der Richtlinie, statt nur angedeutet zu werden.

Nichts, was du schickst, wird für eine öffentliche Galerie verwendet, und Bilder, die in deinem Gespräch entstehen, landen in deinem Gespräch.

Warum das gleichbleibende Gesicht der schwierige Teil ist

Ein schönes Bild zu erzeugen ist inzwischen leicht. Dieselbe Person zweimal zu erzeugen ist es nicht, und das ist der Unterschied zwischen Illustrationen und einem Charakter.

Das Aussehen wird beim Erstellen des Charakters festgelegt und danach auf jeden Render angewendet — eine Szene im Café und eine Szene auf der Straße zwei Wochen später zeigen erkennbar dieselbe Person. Niemand lädt ein Referenzfoto hoch und niemand justiert eine Einstellung — die Konsistenz ist eine Eigenschaft des Charakters, nichts, das du pflegen musst.

Kann mir ein KI-Charakter Bilder von sich schicken?
Ja. Bitte um eines, und der Charakter zeichnet den Moment, in dem du bist, mit jedes Mal demselben Gesicht — das Aussehen wird beim Erstellen des Charakters festgeschrieben statt pro Bild neu ausgewürfelt. Das Bild kommt im Gespräch an.
Warum sehen KI-generierte Charaktere auf jedem Bild anders aus?
Die meisten Werkzeuge behandeln jede Generierung unabhängig, du bekommst also jedes Mal eine neue Person. Konsistenz verlangt, dass das Aussehen als Eigenschaft des Charakters festgelegt und bei jedem Render neu angewendet wird — genau das passiert hier, ohne Referenz-Upload.
Kann der KI-Charakter mit echter Stimme sprechen?
Antworten können als native Telegram-Sprachnachrichten mit Wellenform und Geschwindigkeitsregler ankommen. Jeder Charakter hat eine passende Stimme, die du vor der Wahl vorhören kannst, und du kannst Antworten auf aus, auf Anfrage oder automatisch stellen.
Kann ich einem KI-Charakter ein Foto schicken, das er versteht?
Ja. Schick ein Foto in den Chat, und der Charakter antwortet in seiner Rolle auf das, was wirklich darin ist — eine Aussicht, ein Outfit, eine Zeichnung. Das Bild wird zum Auslesen an einen Drittanbieter weitergeleitet, was in der Datenschutzrichtlinie steht.
Kosten Bilder und Stimme extra?
Sie laufen über dieselbe Energie wie das Gespräch, aufgeladen mit Telegram Stars im Chat, und du kannst das Guthaben jederzeit sehen. Ein Render, der fehlschlägt, wird nicht berechnet.
Kann ich Bilder und Stimme abschalten?
Ja, jedes unabhängig vom anderen. Nichts muss zum Start aktiviert werden, und nichts muss anbleiben.
Kann ich wählen, welche Bild-Engine das Bild zeichnet?
Ja, pro Bild. Verschiedene Engines sind in Verschiedenem besser — Gesichter versus Licht und Atmosphäre — es ist also eine Wahl im Moment, keine Einstellung.
Charakter in Telegram erstellen →

Weiterlesen