Poza słowami

Postać AI, która wysyła zdjęcia i mówi

Ta sama postać, z którą piszesz, potrafi narysować scenę, w której jesteście, odpowiedzieć na głos własnym głosem i spojrzeć na zdjęcie, które właśnie wysłałeś. Nic nie trzeba włączać, a twarz się nie zmienia.

Talaforge › Postać AI, która wysyła zdjęcia i mówi

RPG na samym tekście zawsze uderza w tę samą ścianę: budujesz scenę od godziny i nie ma jak jej zobaczyć. Postać opisuje pokój, a ty wyobrażasz sobie własną wersję. Postać opisuje samą siebie, a obraz z każdą sesją oddala się trochę bardziej od poprzedniego.

Trzy rzeczy zamykają tę lukę i żadnej z nich nie trzeba konfigurować.

Rysują scenę, w której jesteście

Poproś o obraz, a postać narysuje moment, w którym naprawdę jesteście, a nie ogólny portret. Wynik przychodzi w rozmowie, a nie do osobnej galerii, do której trzeba zajrzeć.

Liczy się spójność: zawsze ta sama twarz, bo wygląd jest zablokowany, a nie losowany od nowa. Większość narzędzi graficznych przy każdym generowaniu daje inną osobę i dlatego grafika postaci z nich nigdy nie wygląda dwa razy na tę samą postać.

To ty wybierasz, który silnik rysuje. Różne silniki mają naprawdę różną rękę — jeden lepiej radzi sobie z twarzami, inny ze światłem i atmosferą — a wybór jest przy każdym obrazie, a nie ustawieniem konfigurowanym raz.

Odpowiadają na głos

Odpowiedzi mogą przyjść jako prawdziwa wiadomość głosowa Telegrama — z falą dźwięku, przewijaniem i regulacją prędkości, dokładnie taki sam obiekt jak głosówka od człowieka. Nie plik audio w załączniku, który trzeba pobrać.

Każda postać dostaje głos, który do niej pasuje. Możesz przejrzeć dostępne głosy i posłuchać jednego przed decyzją, a samo zachowanie ma trzy ustawienia: wyłączone, na życzenie albo automatycznie.

To wiadomości głosowe, a nie rozmowa telefoniczna. Nie ma rozmowy na żywo i nic cię nie słucha — ty piszesz, a odpowiedź po prostu przychodzi jako dźwięk.

Patrzą na to, co wysyłasz

Wyślij zdjęcie na czat, a postać je zobaczy. Widok z twojego okna, ubranie, o które pytałeś, rysunek, który zrobiłeś — a odpowiedź jest w roli i dotyczy tego, co naprawdę jest na obrazku, a nie ogólnego potwierdzenia.

To ta rzecz, która ludzi zaskakuje, bo zmienia kierunek całego medium. Do tej pory opisywałeś swój świat słowami. Teraz możesz go po prostu pokazać.

Nic nie trzeba włączać

Między tobą a tym wszystkim nie stoi żaden ekran ustawień. Zdjęcia mogą przychodzić same, gdy scena się rozwija, a przycisk odtwarzania głosu jest pod każdą odpowiedzią od pierwszej wiadomości.

Jedno i drugie chodzi na energii doładowywanej w Telegram Stars wewnątrz czatu. W każdej chwili widzisz, ile zostało.

Co dzieje się z tym, co wysyłasz

Wysłane przez ciebie zdjęcie trafia do zewnętrznego dostawcy, żeby postać mogła się do niego odnieść — tak samo jak twój tekst trafia tam po to, by powstała odpowiedź. To jest zapisane w polityce, a nie tylko sugerowane.

Nic z tego, co wysyłasz, nie służy do budowania publicznej galerii, a obrazy powstałe w twojej rozmowie zostają w twojej rozmowie.

Dlaczego najtrudniejsze jest to, żeby twarz się nie zmieniała

Wygenerowanie ładnego obrazu jest dziś łatwe. Wygenerowanie dwa razy tej samej osoby już nie, i to właśnie różni ilustracje od postaci.

Wygląd zostaje ustalony przy tworzeniu postaci i stosowany przy każdym kolejnym obrazie, więc scena w kawiarni i scena na ulicy dwa tygodnie później przedstawiają rozpoznawalnie tę samą osobę. Nikt nie wgrywa zdjęcia referencyjnego i nikt nie zmienia żadnego ustawienia — spójność jest właściwością postaci, a nie czymś, co utrzymujesz.

Czy postać AI może wysłać mi swoje zdjęcia?
Tak. Poproś o jedno, a postać narysuje moment, w którym jesteście, zawsze z tą samą twarzą, bo wygląd jest blokowany przy tworzeniu postaci, a nie losowany przy każdym obrazie. Zdjęcie przychodzi w rozmowie.
Dlaczego postacie generowane przez AI wyglądają inaczej na każdym obrazie?
Większość narzędzi traktuje każde generowanie osobno, więc za każdym razem dostajesz inną osobę. Spójność wymaga, żeby wygląd był zapisany jako właściwość postaci i stosowany ponownie przy każdym obrazie — i tak to tu działa, bez wgrywania żadnej referencji.
Czy postać AI potrafi mówić prawdziwym głosem?
Odpowiedzi mogą przychodzić jako natywne wiadomości głosowe Telegrama, z falą dźwięku i regulacją prędkości. Każda postać ma pasujący głos, którego możesz posłuchać przed wyborem, a odpowiedzi ustawisz na wyłączone, na życzenie albo automatyczne.
Czy mogę wysłać postaci AI zdjęcie, żeby je zrozumiała?
Tak. Wyślij zdjęcie na czat, a postać odpowie w roli na to, co faktycznie na nim jest — widok, ubranie, rysunek. Obraz trafia do zewnętrznego dostawcy, żeby dało się go odczytać, i jest to napisane w polityce prywatności.
Czy obrazy i głos kosztują dodatkowo?
Chodzą na tej samej energii co rozmowa, doładowywanej w Telegram Stars wewnątrz czatu, a saldo widzisz w każdej chwili. Nieudane generowanie obrazu nie jest naliczane.
Czy mogę wyłączyć obrazy i głos?
Tak, każde z osobna. Nic nie trzeba włączać na start i nic nie musi zostać włączone.
Czy mogę wybrać, który silnik narysuje obraz?
Tak, przy każdym obrazie. Różne silniki są lepsze w różnych rzeczach — twarze kontra światło i atmosfera — więc to wybór podejmowany na bieżąco, a nie ustawienie.
Stwórz postać w Telegramie →

Czytaj dalej