言葉の先へ

写真を送り、声で話すAIキャラクター

一緒に書いてきたキャラクターが、いまいる場面を描き、その人の声で返し、送った写真を見ます。切り替える設定はなく、顔は毎回同じです。

Talaforge › 写真を送り、声で話すAIキャラクター

文字だけのロールプレイは毎回同じ壁に当たります。一時間かけて場面を作ってきたのに、それを見る手立てがありません。キャラクターが部屋を語り、こちらは自分なりの部屋を思い浮かべます。キャラクターが自分の姿を語り、その像は回を重ねるごとに前回からすこしずつ離れていきます。

その隙間を埋めるものが三つあり、どれも設定は要りません。

いまいる場面を描きます

絵を頼むと、決まりきった立ち絵ではなく、いま実際にいる場面を描きます。結果は見に行く別のギャラリーではなく、会話の中に届きます。

肝心なのは一貫性です。毎回同じ顔になるのは、見た目が引き直されずに固定されているからです。多くの画像ツールは生成のたびに別人を返します。そこから出たキャラクターの絵が同じキャラクターに見えないのは、それが理由です。

どのエンジンが描くかは選べます。エンジンごとに手つきは本当に違い、顔が得意なもの、光と空気が得意なものがあります。一度きりの設定ではなく、画像ごとの選択です。

声に出して答えます

返信は本物のTelegramのボイスメッセージとして届きます。波形があり、頭出しができ、再生速度も変えられる、人から届く音声メモと同じものです。ダウンロードが要る音声ファイルの添付ではありません。

どのキャラクターにも似合う声がつきます。用意された声を見比べ、決める前に試し聞きできます。動作は三つから選べます。オフ、頼まれたときだけ、自動です。

これはボイスメッセージであって、通話ではありません。リアルタイムの会話はなく、こちらの声を聞いているものもありません。入力するのは文字で、返事がたまたま音声で届くだけです。

送ったものを見ます

チャットに写真を送ると、キャラクターはそれを見ます。窓からの眺め、迷っている服、描いた絵。返事は当たり障りのない相づちではなく、画像に実際に写っているものについて、キャラクターのまま返ってきます。

これがいちばん驚かれます。やり取りの向きが変わるからです。そこまでは自分の世界を言葉で説明していました。これからは、見せればよくなります。

オンにする設定はありません

これらとのあいだに設定画面は立っていません。場面が進むなかで写真がひとりでに届くこともありますし、スピーカーのボタンは最初の返信から、どの返信の下にもあります。

どちらもエネルギーで動き、エネルギーはチャットの中でTelegram Starsから足します。残りはいつでも見られます。

送ったものはどう扱われるか

送った写真は、キャラクターがそれについて答えられるように第三者の提供元へ渡されます。返信を作るために文章が渡されるのと同じ形です。これは含みではなく、ポリシーに書いてあります。

送ったものが公開のギャラリーを作るために使われることはなく、会話の中で生成された画像は会話の中に残ります。

顔が変わらないことが難しい理由

美しい画像を作ることは、いまでは簡単です。同じ人物を二度作ることは簡単ではありません。そこが挿絵とキャラクターの分かれ目です。

見た目はキャラクターを作るときに決まり、以後のすべての生成に適用されます。だからカフェの場面と、二週間後の街角の場面が、見てわかる同じ人物になります。参照写真を上げる人はおらず、設定をいじる人もいません。一貫性は維持する作業ではなく、キャラクターの性質です。

AIキャラクターは自分の写真を送ってくれますか。
送ります。頼めば、いまいる場面をそのまま描きます。顔が毎回同じなのは、見た目が画像ごとに引き直されるのではなく、キャラクターを作るときに固定されるからです。絵は会話の中に届きます。
AIで作ったキャラクターが毎回違う見た目になるのはなぜですか。
多くのツールは生成をそれぞれ独立に扱うので、毎回別人が出てきます。一貫させるには、見た目をキャラクターの性質として固定し、生成のたびに当て直す必要があります。ここではそうしていて、参照写真を上げる必要はありません。
AIキャラクターは本物の声で話せますか。
返信はTelegram本来のボイスメッセージとして届き、波形も再生速度の調整もあります。どのキャラクターにも似合う声があり、決める前に試し聞きできます。返信はオフ、頼まれたときだけ、自動から選べます。
AIキャラクターに写真を送って、内容をわかってもらえますか。
はい。チャットに写真を送ると、実際に写っているものについてキャラクターのまま答えます。景色でも、服でも、描いた絵でもです。画像は読み取りのために第三者の提供元へ渡され、そのことはプライバシーポリシーに書いてあります。
画像と音声は追加料金ですか。
会話と同じエネルギーで動きます。エネルギーはチャットの中でTelegram Starsから足し、残高はいつでも見られます。失敗した生成は課金されません。
画像と音声はオフにできますか。
できます。どちらも別々にです。始めるために何かを有効にする必要はなく、何かをオンのままにしておく必要もありません。
どの画像エンジンが描くかを選べますか。
選べます。画像ごとにです。エンジンによって得意が違い、顔が得意なものと、光や空気が得意なものがあります。だから設定ではなく、その場で決めることになっています。
Telegramでキャラクターを作る →

続けて読む