盯着人们围绕这一类产品打的字看,有一簇今年长得比任何功能诉求都快:“能记住你的 ai”“记忆力好的 ai 聊天”“有记忆的 ai 机器人”“能记住对话的 ai”。它是我们英文数据里最大的一簇不带品牌名的搜索词,而在我们追踪的每一种语言里都有它的表亲——ai that remembers you、記憶してくれるAI、기억하는 AI、ia que te recuerda、ki mit gedächtnis。
它长起来的一部分原因,是几个最大的通用助手花了整个 2026 年宣布“我们现在会记住你了”,把这个词送进了所有人嘴里。另一部分原因是同一枚硬币的另一面:那些养了一年角色、然后眼看着它把自己忘掉的人。两群人问的是同一个问题,而大多数页面用错误的名词回答它。
上下文不是记忆
你跟任何一个 AI 角色聊天时,模型一次只能看到一定量的文字。这个量就是上下文窗口。你最近说的话都在里面;某个点之前的一切都不在。一个很大的上下文窗口,有一阵子会让人觉得像记忆,因为一个长长的夜晚装得进去。然后你关掉聊天,下周回来,窗口从空白开始。什么都没存下来。不是角色忘了你;它从来就没有一个地方可以把你放着。
记忆是另一回事:关于你的事实,被写在对话之外的某个地方,在相关的时候被带回来。你给她起的名字。你上夜班。灯塔那个笑话是一个老梗。一个有记忆的服务,可以丢掉整个上下文窗口,到了星期一依然知道你是谁。
所以当一个页面用“我们的 AI 有超大的上下文窗口”来回答“它记得我吗”,它答的是另一个问题。长上下文是件好东西。但它不是人们在要的东西。
藏起来的记忆为什么会以一种特定的方式出错
大多数确实有记忆的平台,都把它藏着。聊天背后的某处,有一个进程在读你说的话、写笔记,而你永远看不到这些笔记。它一直好用,直到不好用为止——而一旦不好用,它出错的方式极难挽回,因为你看不见哪儿错了。
角色把你姐姐的名字记错了一次。笔记就写下了。从那以后,每一个提到你姐姐的场景都有点不对,你说不出为什么,而“不,她叫安娜”修好了上下文窗口,却修不了那条笔记。或者一句随口的话——某个晚上你说累了——变成角色几个月里反复提起的事实。用户把这描述为“它变得怪怪的”“感觉不像她了”。实际发生的,是一份文件走样了,而没有人能把它打开。
这就是“能记住你的 ai”背后那句抱怨的老实版本。很少是 AI 什么都不记得。而是它记得的东西是错的、看不见的、永久的。
能打开的记忆是什么样
在 Talaforge,每个角色都有一页记忆。那是一份她所知道的关于你的事的清单,平白、可读——而且可以编辑。你可以读它,改一行,删一行,或者自己添一行。你想让她知道某件事又不想在场景里专门提起,就写在那里。你想让她忘掉一整条线索,就把它删掉。
这彻底改变了出错的方式。一条错的事实是两秒钟的修改,而不是一场缓慢的走样。一条过时的记忆是可以修剪掉的。而“它到底知道我什么”——每个在意隐私的人都该向每一个 AI 服务提的问题——有了一个可以滚动翻看的答案,而不是政策里的一段话。
- 按角色分:每个角色保留她自己关于你的记忆。冷面侦探不知道你跟酒保说过什么。
- 按线索分:同一个角色之内,不同的故事线各记各的笔记,支线不会漏进主线。
- 由你编辑:读它,改它,删它,或者直接写进去。
- 什么都扛得住:给角色换底下的 AI 模型、重新生成一条回复、把一个场景分成两条路走——记忆都还在。
最后一点比看上去要紧。博客上另有一篇文章讲人们离开那些下线了自家角色所依赖的模型的平台。当记忆是一件独立、可见的东西,换模型就像给一个拿着同一份剧本、同一份笔记的角色换演员。当记忆藏在模型的上下文里,换模型就是从头再来。
如何测试任何一个服务是否有真记忆
你不需要相信我们的话,也不该轻信任何人的。这个测试要两天,不花一分钱。
- 在一个晚上,告诉角色三件具体的事——一个名字、一个偏好、一个小故事。
- 关掉聊天。那天不要再打开。
- 第二天回来,开一段新对话,三件事一件都不要提。
- 看哪几件不用提示就自己回来了,以及你能不能找到它们存在哪里。
只有上下文窗口、没有记忆的服务,在第三步就栽了。记忆藏着的服务过得了第三步,栽在第四步的后半段。记忆能打开的服务全部过关——而且如果它记错了什么,你能确切看到错在哪儿,并把它改掉。最后这一点就是全部的区别,也是该去找的东西。