用《哈利波特》演示 AI 智能体的记忆是如何形成的
一家公司把《哈利波特与魔法石》喂给自家 AI 智能体逐章记录,展示了信念、事实与显著性等记忆结构的演变过程。
一个 AI 智能体读完《哈利波特与魔法石》之后,会「记住」什么?瑞典公司 Squidler 在其官方博客中发布了一篇技术分享,把这部广为人知的小说逐章输入自家智能体,让它在每一章结束后进行一次类似「做梦」的整理,从而可视化地展示智能体记忆的建立、修正与失效过程。
记忆如何被记录
文章将智能体内部维护的条目抽象为「信念(beliefs)」,并按类型细分为世界事实(world-fact)、状态(state)、合并完成或过期(merged / completed / expired)等。每个条目都带有「显著性(salience)」分数,代表智能体在写下它时赋予的权重——分数高的往往与剧情主线相关,分数低的则可能被忽略。
以《魔法石》第一章为例,智能体在读完后形成了 11 条有效信念、3 条完成或合并、0 条被推翻。其中显著性最高的条目包括:
- 德思礼一家住在女贞路 4 号(显著性 1.00);
- 德思礼夫妇认为波特一家「不太像德思礼家的人」(显著性 1.00);
- 麦格教授预言哈利·波特将会出名(显著性 0.90);
- 1991 年 6 月,女贞路 4 号门口的台阶上放着一捆毛毯(显著性 0.90)。
信念会随章节变化
随着剧情推进,智能体不断修正、更新甚至推翻原有的信念。作者建议读者在 Focus 菜单中选择「寻找魔法石」任务线,然后逐步翻到末尾几章,可以观察到智能体在大部分时间里一直把奇洛教授记成「一个紧张兮兮、过去一年过得不顺的男人」,直到真相揭露那一幕,这条信念才被推翻。
不完美之处
文章坦承系统并不完美。例如直到全书结束,智能体仍然「坚信」斯莱特林赢得了学院杯,而实际上邓布利多在最后几页把加分判给了格兰芬多。作者认为,这恰恰是用一部人人熟知的小说来跑实验的价值——读者能立刻发现错误。每条信念都可点击查看背后支撑它的原始记忆片段,引用自原文的部分会被划掉。
整体定位
这篇博客属于 Squidler「Building a useful agent · Memory」系列的延伸,其立意并非发布新模型或新基准,而是用通俗内容帮助读者理解「智能体的记忆」这一抽象概念。文章未披露底层模型架构、参数规模或评测指标,主要价值在于可视化交互与教学示例。
