桃子桃子快讯
返回首页
产品功能

Anthropic 托管智能体平台连推六项更新

Anthropic 在 CMA 平台一次性推出技能上限扩至 500、思考力度五档调速、种子会话、子 agent 线程级流…

2026.07.23 · 周四4 分钟阅读

Anthropic 在其托管智能体平台(Claude Managed Agents,简称 CMA)上一口气推出六项更新,涵盖技能容量、推理调速、会话创建、子 agent 可观测性以及 webhook 事件体系等多个维度。这是该公司近 45 天内继 Fable 5、Mythos 5、Sonnet 5 降价、Claude Code 高频迭代之后的又一次集中发力,反映出 Anthropic 在 agent 基础设施层面的密集投入。

技能上限从 20 跃升至 500

CMA 中的「技能(Skills)」是注入给 agent 的专业指令知识包,此前单个会话的上限仅为 20 个。对企业级场景而言,这一容量很快就会触及瓶颈:以金融客服 agent 为例,开户、KYC、反洗钱、投诉处理、合规免责、多语言切换等场景单独配置就可能用掉七八个技能位,再加上不同地区监管差异和 A/B 测试版本,几乎必然撞上限。

本次更新将该上限直接拉到 500,且这 500 个技能位由同一会话内所有 agent 共享,统一运行在托管沙盒中,agent 之间共享内存与环境变量,由协调器统一调度。官方称这一容量足以覆盖一个完整业务单元,也支持把整套代码规范、CI 流水线配置、部署目标等一并塞入单会话,实现从开发到上线的全链路贯通。

思考力度五档调速

「思考力度(effort)」参数此前在 API 层已可使用,但 CMA 内的 agent 此前无法单独配置,只能跟随会话级别的默认档位,导致「今天几号」与「审计 500 页财报」共用同一深度,简单的过度推理在持续消耗 token。

新版本将 effort 直接写入每个 agent 的模型配置,提供 low / medium / high / xhigh / max 五档。同一会话内的不同 agent 可按任务难度运行在不同档位,例如分流 coordinator 用 low、产品答疑用 medium、投诉升级用 high、法律合规用 max,为成本与质量提供连续可调的旋钮。

冷启动归零与子 agent 透明化

会话创建流程从两步压缩为一步:通过 POST /v1/sessions 直接携带最多 50 条 initial_events,新会话一经生成即具备完整上下文,省去高并发场景下逐条注入的往返延迟。同时,agent 更新接口中的 version 字段变为可选项,单流程场景不再受 409 版本冲突错误困扰。

子 agent 的可观测性也取得进展。此前主 agent 已有会话级 event_deltas 实时预览,但子 agent 仍处于「黑盒」状态。本次更新把流式订阅下探到线程级,每个子 agent 独立线程的思考与写入进度可被外部实时订阅,跑偏、卡死等问题不再需要等待超时才能发现。

7 种新 webhook 补齐生命周期

CMA 在 6 月底已上线覆盖 agent 与部署生命周期的 webhook,本次补齐环境与记忆存储两大板块,共新增 7 种事件类型,包括 4 种环境事件与 3 种记忆存储事件。至此,平台的环境搭建、agent 部署、运行状态、记忆管理全流程均可通过事件驱动与外部系统打通,例如环境暂停触发告警、记忆更新同步至自有数据库、新环境创建自动挂载监控等。这一变化被官方视为 CMA 从「API 产品」走向「可运维平台」的最后一块拼图。

战略落点:OS 级深度

进入 2026 年下半年,AI agent 基础设施赛道的迭代节奏已按天计算:OpenAI 把聊天、编程与自主工作整合进 ChatGPT 超级应用争夺入口,Google 借助 GCP + TPU 与协议标准构建底层护城河,Anthropic 则押注 OS 级深度——以托管沙盒、全栈 agent 控制与思考力度调速,在单 agent 能力密度上持续加码。技能上限从 20 跃至 500,是其在企业级 agent 操作系统化方向上的一次关键扩张。

信源