Больше, чем слова

ИИ-персонаж, который присылает фото и говорит вслух

Тот же персонаж, с которым ты пишешь, может нарисовать сцену, в которой вы находитесь, ответить вслух собственным голосом и посмотреть на фото, которое ты только что отправил. Ничего не нужно включать, и лицо остаётся тем же.

Talaforge › ИИ-персонаж, который присылает фото и говорит вслух

Текстовая ролевая игра каждый раз упирается в одну и ту же стену: ты час строишь сцену, а увидеть её невозможно. Персонаж описывает комнату — ты представляешь свою версию. Персонаж описывает себя — и с каждой сессией картинка уплывает чуть дальше от прошлой.

Эту дыру закрывают три вещи, и ни одну не нужно настраивать.

Рисует сцену, в которой вы находитесь

Попроси картинку — и персонаж нарисует момент, в котором вы действительно находитесь, а не дежурный портрет. Результат приходит в разговор, а не в отдельную галерею, куда нужно идти проверять.

Главное здесь — постоянство: каждый раз одно и то же лицо, потому что облик закреплён, а не разыгрывается заново. Большинство генераторов картинок выдают нового человека на каждой генерации — поэтому арты персонажей из них никогда не ощущаются одним и тем же персонажем дважды.

Какой движок рисует, выбираешь ты. У разных движков действительно разная рука — один лучше в лицах, другой в свете и атмосфере, — и выбор делается на каждую картинку, а не в настройках раз и навсегда.

Отвечает вслух

Ответы могут приходить настоящим голосовым сообщением Telegram — с волной, перемоткой, регулировкой скорости, тем же объектом, что и голосовое от человека. Не аудиофайлом-вложением, который нужно скачивать.

У каждого персонажа голос, который ему подходит. Доступные голоса можно перебрать и прослушать, прежде чем выбрать, а у поведения три режима: выключено, по запросу или автоматически.

Это голосовые сообщения, а не звонок. Живого разговора нет, и ничто тебя не слушает — ты печатаешь, а ответ просто приходит звуком.

Смотрит на то, что ты отправляешь

Отправь фото в чат — и персонаж его увидит. Вид из твоего окна, наряд, о котором ты спрашивал, твой рисунок — и ответ будет в образе и о том, что действительно на картинке, а не дежурное «понял».

Именно это удивляет людей больше всего, потому что меняет направление среды. До этого момента ты описывал свой мир словами. Теперь его можно просто показать.

Ничего не нужно включать

Между тобой и всем этим не стоит страница настроек. Фото могут приходить сами по ходу сцены, а кнопка озвучки есть под каждым ответом с первого сообщения.

И то и другое работает на энергии, которая пополняется за Telegram Stars прямо в чате. Сколько осталось, видно в любой момент.

Что происходит с тем, что ты отправляешь

Отправленное тобой фото передаётся стороннему провайдеру, чтобы персонаж мог о нём ответить — так же, как передаётся твой текст, чтобы сгенерировать ответ. Это записано в политике, а не подразумевается.

Ничто из отправленного тобой не идёт в публичную галерею, а картинки, сгенерированные в твоём разговоре, остаются в твоём разговоре.

Почему одно и то же лицо — самое трудное

Сгенерировать красивую картинку теперь легко. Сгенерировать одного и того же человека дважды — нет, и в этом разница между иллюстрациями и персонажем.

Облик фиксируется при создании персонажа и применяется к каждой генерации после, так что сцена в кафе и сцена на улице две недели спустя — узнаваемо один и тот же человек. Никто не загружает референс и не крутит настройку — постоянство это свойство персонажа, а не то, что ты поддерживаешь.

Может ли ИИ-персонаж прислать мне свои фото?
Да. Попроси — и персонаж нарисует момент, в котором вы находитесь, каждый раз с тем же лицом, потому что облик закрепляется при создании персонажа, а не разыгрывается заново на каждой картинке. Картинка приходит в разговор.
Почему ИИ-персонажи выглядят по-разному на каждой картинке?
Большинство инструментов обрабатывают каждую генерацию независимо, поэтому каждый раз получается новый человек. Для постоянства внешность должна быть закреплена как свойство персонажа и применяться заново при каждой генерации — так это устроено здесь, и загружать референс не нужно.
Может ли ИИ-персонаж говорить настоящим голосом?
Ответы могут приходить нативными голосовыми сообщениями Telegram — с волной и регулировкой скорости. У каждого персонажа подходящий голос, который можно прослушать до выбора, а ответы настраиваются: выключено, по запросу или автоматически.
Могу я отправить фото ИИ-персонажу, чтобы он его понял?
Да. Отправь фото в чат — и персонаж ответит в образе о том, что действительно на нём: вид, наряд, рисунок. Изображение передаётся стороннему провайдеру, чтобы его прочитать, — это указано в политике конфиденциальности.
Картинки и голос стоят отдельно?
Они работают на той же энергии, что и разговор, пополняемой за Telegram Stars прямо в чате, и баланс виден в любой момент. Неудавшаяся генерация не списывается.
Можно выключить картинки и голос?
Да, любое из двух независимо. Ничего не нужно включать для начала и ничего не обязано оставаться включённым.
Могу я выбрать, какой движок рисует картинку?
Да, на каждую картинку. Разные движки сильны в разном — лица против света и атмосферы, — так что это выбор в моменте, а не настройка.
Создать персонажа в Telegram →

Читать дальше

Чему мы учимся, создавая персонажей