这一页顶上的那张图,和角色卡上的那张,相隔好几个小时才出现,画风不同,来自不同的请求,都发生在一场再普通不过的对话中间。没有人上传参考图,也没有人打开设置页。值得讲的正是这一点,因为这通常就是不成立的那一点。
AI 画一个人时的老问题
让大多数图像工具画同一个角色两次,你会得到两个人,只是恰好符合同一串形容词。棕色卷发、蓝眼睛、灰毛衣——然后是另一张脸。描述留下来了,人没有。
如果只是一张插图,这没什么。放进对话里就是致命的,因为一个伴侣的全部意义,就在于他是某个特定的人。每条消息都重新抽一次的脸,只是一个穿着同样衣服的陌生人;哪怕说不清哪里不对,你也会立刻感觉到。
真正被锁住的是什么
在这里创建一个角色时,他的外貌是固定在角色身上的,而不是每次都从文字里重新推导一遍。之后的每一张图都从那个锚点出发,只改场景要改的东西——房间、衣服、光线、年代、情绪,还有画面里的其他人。
所以下面这几帧几乎在所有事情上都对不上,却在他是谁这件事上完全一致。看咖啡馆那张:原始角色卡上的灰色罗纹毛衣和那颗宇宙泪滴,没人要求,它们自己跟来了。再看那间客厅——换了个世纪,换了套配色,硬侧光,坐在那里听人说话的仍然是同一张脸。






左右滑动,或点开任意一帧。这些全都出自和同一个角色的同一场对话。
没有开过任何开关
很多人以为这是一个需要你去打开的功能。它不是。场景需要的时候,图片会自己出现——角色觉得某个瞬间值得给你看,就把它画出来——而如果你更想听而不是读,语音按钮从第一条消息起就在回复下面。
当然你也可以管着它:直接要一张图,他就给你画;不想被图片突然袭击,就把它设成只在你开口时才发;或者干脆全关掉。但默认状态是对话里有图片——就像和一个身处某地的人聊天,本来就会有图片一样。
反过来也一样
给他发一张照片,他会看。你窗外的景色、那件你拿不准的衬衫、你自己画的一张画——他会不出戏地回应画面里真正有的东西,而不是回应你不得不替他写的一句说明。
这样回路就闭上了:他让你看见他在哪儿,你让他看见你在哪儿,对话也就不再只是一个输入框。
该说清楚的细节
出图要花能量,能量在聊天里用 Telegram Stars 充值,余额随时都能看。渲染失败或被拦下的不计费——你不会为一张没拿到的图付钱。每天还有上限,所以一个失控的下午也掏不空余额。
画图用哪个引擎由你选,结果落在对话里,而不是别处的某个图库。成人内容需要在机器人里通过年龄验证才能打开;这一页和本站其余部分,就是你现在看到的样子。
拿你自己的角色试试
一句话就够开一个角色——一个身份、一种情绪、一个名字——剩下的会替你起好草稿,而且永远可以改。通常你还没想清楚他到底是谁,第一张图就已经到了。
如果这个角色值得让别人也认识,他可以变成一个独立的 Telegram 机器人,有自己的 @名字,几分钟搞定,不用写代码。