新智元报道
过去 45 天,Anthropic 动作频频:Fable 5 与 Mythos 5 相继落地,Sonnet 5 降价抢占市场,Claude Code 近乎日更。继昨日 Cowork 迭代后,今日 Anthropic 又在托管智能体平台(CMA)上推出六项重大更新:
- 技能上限从 20 提升至 500:单会话可承载整座企业知识库;
- 思考力度五档可调:简单任务路由以节省 Token,深度推理全力输出;
- 种子会话一步创建:支持直接带入 50 条初始事件,实现冷启动归零;
- 子 Agent 实时流下探至线程级:每个子 Agent 的运行状态与思维过程实时可见;
- 新增 7 种 Webhook:覆盖环境与记忆存储全生命周期,取代轮询机制;
- Agent 版本字段可选:简化单流程场景下的版本管理开销。
单会话支持 500 个技能、运行完整企业知识库,Anthropic 正致力于将 Agent 打造为操作系统级的基础设施。
技能上限暴涨至 500:单会话承载整个业务部门
CMA 的“技能”(Skills)是为 Agent 注入专业指令的知识包,此前上限仅为 20 个。然而,仅一个金融客服 Agent 就需覆盖开户、KYC、反洗钱、投诉处理、合规免责及多语言切换等七八项功能,若叠加监管差异与 AB 测试版本,极易触及天花板。
如今,这一限制被直接突破至 500。这 500 个技能位由会话内所有 Agent 共享,运行于统一的托管沙盒中,共享内存与环境变量,并由协调器统一调度,足以支撑一个完整的业务单元。
开发者甚至可将整套代码库规范、CI 流水线配置及部署目标全部纳入单一会话,实现从编码到上线的全流程自动化。
思考力度五档调速:精准平衡成本与质量
虽然 API 层面早已提供“思考力度”(effort)参数,但 CMA 中的 Agent 此前无法单独设定,导致整个会话只能统一运行默认档位。无论是查询日期还是审计财报,均消耗同等算力,造成简单任务的 Token 浪费。
现在,思考力度可直接写入每个 Agent 的模型配置,提供 low、medium、high、xhigh、max 五个档位。在多 Agent 客服系统中,分流协调器可设为 low,产品答疑用 medium,投诉升级用 high,法律合规则启用 max。同一会话内,不同 Agent 可根据任务难度动态调整算力,实现了成本与质量的精细化控制。
冷启动归零与子 Agent 可观测性升级
以往创建 CMA 会话需两步:先 POST 空壳,再逐条插入初始事件,高并发下延迟显著。现支持一步到位,通过 POST /v1/sessions 直接携带最多 50 条 initial_events,使会话初始化即明确任务目标。
同时,Agent 更新接口的 version 字段变为可选。在单流程场景中,开发者无需再传递版本号进行并发控制,避免了因版本不匹配导致的 409 错误,大幅简化开发流程。
在可观测性方面,此前 CMA 仅支持会话级的 event_deltas 预览主 Agent 输出,子 Agent 仍处于“黑盒”状态。此次更新将监控粒度下探至线程级,开发者可订阅子 Agent 的独立线程流,实时掌握其思维路径与执行进度。
7 种新 Webhook 补位:终结轮询时代
继 6 月底上线 Agent 与部署生命周期 Webhook 后,此次更新补充了 4 种环境事件与 3 种记忆存储事件。至此,CMA 实现了从环境搭建、Agent 部署、运行状态到记忆管理的全生命周期事件驱动。
外部系统可据此实现自动化运维:环境暂停自动触发告警,记忆存储更新同步至数据库,新环境创建自动挂载监控。这标志着 CMA 从单纯的"API 产品”正式进化为“可运维平台”。
Anthropic 押注 OS 级深度
截至 2026 年 7 月,AI Agent 基础设施竞赛已进入深水区,更新频率按天计算。各大巨头策略分明:
- OpenAI 赌入口:将聊天、编程与自主工作整合进 ChatGPT 超级应用,凭借用户基数锁定开发者生态;
- Google 赌基础设施:依托 GCP、TPU 及协议标准,构建底层护城河;
- Anthropic 赌 OS 级深度:通过托管沙盒、全栈 Agent 控制及思考力度调速,深耕单 Agent 的能力密度。
从 20 到 500 的技能上限跨越,折射出 Anthropic 的战略意图:让 Agent 成为如操作系统般的基础设施。而当前的迭代速度表明,这一愿景正在加速变为现实。
参考资料:
https://x.com/ClaudeDevs/status/2080009523952263295?s=20
编辑:摩西

