AI 工具选择指南演变:从聊天机器人到智能体
Simon Willison 评点 Ethan Molnick 的 AI 工具指南,梳理从聊天模式向智能体系统的转向,并…
知名 AI 评论者 Simon Willison 在博客中回顾了 Ethan Molnick 所维护的「用哪个 AI 干活」指南的演变,指出这份指南在过去一年里发生了明显转向:从以 ChatGPT、Claude、Gemini 等聊天模型为主,演变为以智能体(agentic)系统为核心,主流模型也从 o3、Claude 4 Opus、Gemini 2.5 Pro 等转向更强调长时任务执行能力的产品形态。
从聊天到智能体的转向
Willison 表示,Ethan Molnick 一年前的指南核心仍是「聊天」,「深度研究」仅作为辅助模式出现;而今年的版本则把重点放在智能体系统上,即「AI 能够在一次会话中完成相当于人类数小时工作的任务」。这一变化反映了 2024 至 2025 年间主流 AI 厂商在产品路线上的共识——从对话式交互走向可执行多步骤操作的代理式交互。
不过,Willison 也提到,Gemini 在新一版指南中并未出现在主流推荐里。原因是 Google 至今尚未在「Codex / ChatGPT Work / Cowork」这类智能体品类中拿出明确的产品,Gemini Spark 仍未证明其能力。
各家智能体模式梳理
围绕「给 AI 一台电脑用」这一最强使用方式,Willison 梳理了几家厂商的产品命名:
- ChatGPT 体系:智能体模式称为 Work(聊天形态),桌面应用内对应 Codex;移动端 Work 与桌面端 Work 在体验上有显著差异,桌面端相当于 Codex 的「友好外壳」。
- Claude 体系:智能体模式称为 Cowork(聊天形态),桌面应用内对应 Code。
- 各家命名彼此并不对应,「Work」和「Cowork」在聊天和桌面场景下含义不同,且因可访问本地计算机而拥有更多能力。
Willison 特别指出,移动端 ChatGPT 的 Work 模式解锁了 Code Interpreter 容器原本被限制的互联网访问能力,这是其与普通 Chat 模式的关键区别。
命名混乱与产品体验
Willison 直言,这些模式的命名「不会变得更不让人困惑」,ChatGPT Work、Codex、Claude Cowork、Code 之间的对应关系无规律可言,桌面端 Work 与聊天端 Work 行为不同,更增加了理解成本。对希望系统比较各家智能体产品的用户而言,他建议直接阅读 Ethan Molnick 的原始指南,并按实际任务场景选择对应模式。
总体而言,这篇评论并未发布新信息或新数据,而是以第三方视角对当下 AI 智能体产品的形态和体验做了一次轻量级梳理,可作为理解主流厂商智能体布局的辅助参考。
