奥特曼预言:6个月内ChatGPT将深度接管用户生活
奥特曼称下一代AI将在半年内实现屏幕级感知与全量生活上下文,OpenAI的Chronicle与Dreaming V3已现…
OpenAI首席执行官奥特曼在近期面对硅谷实习生的对话中抛出一个大胆判断:「终极AI助理」距离真正可用只差「一次模型迭代 / 6个月」。他描述的画面是:ChatGPT的后继产品可以持续观看你的屏幕,记录每一次会议和通话,并掌握你生活的全部背景。这一次,他强调的不是更强的记忆或更大的上下文,而是屏幕级感知与全量记录的「人生级别上下文」积累。在他看来,这标志人机关系将从「偶尔对话」走向「持续共生」。
雏形已现:Chronicle 与 Dreaming V3
OpenAI的桌面端ChatGPT在语音模式下已能获取屏幕上下文,企业版也具备会议记录与总结能力。更具标志性的两个动作分别是Codex中的Chronicle与ChatGPT中的Dreaming V3。
- Chronicle:今年4月21日在Codex中以研究预览版形式上线,通过后台间歇性屏幕截图与OCR生成「你最近在做什么」的记忆,以本地加密Markdown文件保存,用于帮助Codex理解跨时间、跨项目的上下文。OpenAI主席Greg Brockman体验后用「surprisingly magical」形容其效果,内部代号为「telepathy」(心灵感应)。官方文档同时提示了提示注入、本地未加密存储、需用户授权等风险,且用户可随时暂停。
- Dreaming V3:今年6月在ChatGPT上线,是记忆系统的最新架构。后台自动从对话历史合成记忆状态,具备时间感知能力,能减少过时信息。例如用户曾说「七月要去新加坡」,时间过后系统会自动更新为「你七月去了新加坡」。用户可在记忆摘要页查看与编辑。
Dreaming V3 的实测提升
OpenAI内部评估显示,Dreaming V3相比上一代实现明显跃升:
- 事实召回率:从 67.9% 提升至 82.8%
- 偏好遵循:从 55.3% 提升至 71.3%
- 时间敏感准确性:从 52.2% 提升至 75.1%
- 计算效率:提升约 5 倍,因此可下放至免费用户层
Chronicle与Dreaming V3是两条并行但不同的产品线:前者侧重屏幕上下文、服务于Codex编程场景,后者侧重对话记忆合成、服务于ChatGPT通用对话。合在一起,已在方向上接近奥特曼所描述的「始终在线、深度个性化」,但仍处研究预览与分阶段推送阶段。
行业全景:巨头集体押注持久记忆
不只是OpenAI,过去几个月整个AI行业几乎在同一时间向「持久记忆」方向集中发力。
- 谷歌:在企业级Gemini Agent平台上推出Memory Bank,允许开发者为自家Agent接入跨会话记忆层,自动从对话中提炼用户偏好、关键节点与显式指令,目前仍偏开发者基础设施,尚未铺到普通消费者Gemini对话框。
- Anthropic:今年3月向Claude所有用户(全量含免费版)开放持久记忆,后台根据对话总结用户数据;4月又为开发者侧的Managed Agents上线持久记忆公测版,Netflix等企业客户已用于生产环境,并称企业用户错误率下降 97%。
- 第三方:Mem0等记忆层项目尝试做跨平台的记忆中间件,同时对接OpenAI、Anthropic与开源模型,让开发者不必被锁定在单一厂商。
各路玩家同时押注同一个方向,意味着行业已经意识到一个被回避的问题:如果每家巨头各自为政,最终用户将在不同平台里养出多个互不相通的「自己」。
记忆护城河:比模型更深层的竞争
把视野拉远来看,模型性能的领先可能三个月就被翻盘,但用户记忆是越攒越厚的累积型资产。
- 用户在一个AI平台上沉淀的上下文越完整,离开它的迁移成本就越高,平台对用户的锁定也就越深。
- 当ChatGPT、Claude、Gemini各自的记忆互不互通时,用户事实上被分散在三个不同发展轨迹的「数字自我」里。
这意味着,记忆正在取代模型能力,成为AI平台下一阶段的核心护城河。奥特曼的6个月预言,既是对下一代AI助理的产品愿景,也是一次明确的商业预判:谁先把用户的记忆攒得足够厚,谁就先一步把用户焊在自己的生态里。
