Anthropic CMA六项更新:打造AI Agent操作系统级能力

近一个半月以来,Anthropic的产品迭代节奏几乎没有停歇:Fable 5与Mythos 5同步上线,Sonnet 5推出降价策略抢占市场,Claude Code更是保持每日更新的频率。就在Cowork完成最新迭代的次日,Anthropic又在托管智能体平台CMA上一次性推出了六项重磅更新。
这六项更新覆盖了智能体技能容量、推理资源调配、启动效率、可观测性、运维打通等多个核心维度,每一项都在进一步强化CMA作为企业级智能体托管平台的能力边界,甚至让人不禁感叹:Anthropic这是在给智能体安装专属操作系统。
技能上限暴涨至500,单会话承载完整业务单元
CMA中的技能(Skills)是为智能体注入专业指令的知识包,此前单会话的技能上限仅为20个。对于金融客服类智能体来说,仅覆盖开户、KYC、反洗钱、投诉处理、合规免责、多语言切换就需要七八个技能,再加上不同监管区域的适配版本、AB测试分支,很快就会触及上限。
此次更新将技能上限直接提升至500个,所有技能由会话内的所有智能体共享,运行在统一的托管沙盒中,智能体之间可以共享内存与环境变量,由协调器统一调度,完全可以支撑一个完整的业务部门的智能体集群需求。更值得一提的是,用户甚至可以将整套代码库规范、CI流水线配置、部署目标全部导入单个会话,让智能体从代码编写到上线部署全流程都能精准匹配企业标准。
思考力度五档可调,平衡成本与推理质量
思考力度(effort)参数在通用API层面早已存在,但在CMA平台中,此前无法为单个智能体单独配置,整个会话只能使用统一的默认档位。这就导致简单的查询任务也会调用全量推理资源,造成Token的无谓消耗。
现在用户可以直接在每个智能体的模型配置中设置思考力度,一共提供五档可选:low、medium、high、xhigh、max。以多智能体客服系统为例,分流协调器可以使用low档位快速分发请求,产品答疑环节使用medium档位兼顾效率与准确性,投诉升级场景切换至high档位进行深度处理,而法律合规类任务则可以拉满max档位保证推理严谨性。这一更新让智能体集群的成本与质量之间有了更精细的调节空间。
简化冷启动流程,优化开发与运维体验
此前创建CMA会话需要分两步完成:先发起请求创建空会话,再逐条导入初始事件,在高并发场景下,多次往返请求会叠加延迟,拉长冷启动时间。此次更新将流程合并为一步,用户在调用POST /v1/sessions接口时可以直接携带initial_events参数,最多支持50条初始事件,会话创建完成即可直接进入预设工作状态。
同时,智能体更新接口的version字段也改为可选参数。此前每次更新都需要传入版本号进行并发控制,版本不匹配时会直接返回409错误,在单流程的简单场景下,这一要求会增加不必要的开发开销,现在可以根据场景灵活选择是否配置版本校验。
线程级子agent观测,告别黑盒调试
6月底CMA刚上线了会话级的event_deltas功能,可以实时预览主智能体的文本输出,但子智能体的运行状态依然是黑盒:如果子智能体出现逻辑偏差或者执行卡顿,开发者只能等待超时后才能发现问题。
此次更新将可观测性下探到线程级别,用户可以订阅子智能体的独立线程流,实时查看每个子智能体的思考与执行进度,彻底解决了子agent调试难、排查慢的问题。
7种新webhook补全生命周期,终结轮询时代
CMA在6月底已经上线了针对智能体与部署生命周期的webhook功能,此次更新又新增了4种环境事件与3种记忆存储事件,至此CMA的完整生命周期——从环境搭建、智能体部署、运行状态监控到记忆管理,全部可以通过事件驱动的方式与外部系统打通。
开发者可以实现环境暂停时自动触发告警、记忆存储更新时同步到企业自有数据库、新环境创建时自动挂载监控工具等场景,这也意味着CMA终于完成了从单一API产品到可运维企业级平台的最后一块拼图。
行业竞赛进入深水区,Anthropic押注OS级智能体
截至2026年7月,AI智能体基础设施的竞争已经进入深水区,头部厂商的更新频率已经达到按天计算的级别。不同厂商选择了截然不同的竞争路径:OpenAI押注入口场景,将聊天、编程、自主工作全部整合进超级应用,依靠庞大的用户基数锁定开发者生态;Google则聚焦底层基础设施,通过云服务、专用芯片与自研协议标准构建技术护城河;而Anthropic则选择了OS级深度的赛道,通过托管沙盒、全栈智能体控制与精细化的思考力度调节,在单智能体的能力密度上做文章。
从20到500的技能上限升级,Anthropic的目标清晰可见:让智能体成为像操作系统一样基础的生产工具。而此次密集的更新节奏也给出了答案:这一天正在快速到来。


