Claude Opus 5 上线:默认 100 万 Token 上下文、12.8 万输出,并支持会话中动态增删工具
旗舰模型
模型级美国 / 全球1M context128K output$5 / $25
🔎 事实与证据Anthropic 7 月 24 日上线 Claude Opus 5,API 价格为每百万输入/输出 Token 5/25 美元,与 Opus 4.8 相同;默认和上限均为 100 万 Token 上下文、最大输出 12.8 万 Token,thinking 默认开启。模型可在 Claude API、Amazon Bedrock、Google Cloud 和 Microsoft Foundry 使用。
🏢 影响与用户长上下文、默认思考和会话中工具变更更适合复杂编码与企业 Agent,也降低短提示缓存门槛。迁移团队需复核 max_tokens、成本、缓存和禁用 thinking 的限制;更大上下文仍可能出现信息衰减,且快速模式只在 Claude API 研究预览。
关键节点:1M context、128K output、$5/$25 每百万 Token。风险边界:默认 thinking 会改变延迟和输出预算,动态工具与 fallback 仍为 Beta。
Google Agent Search 允许下调存储与 QPM 订阅阈值,企业搜索容量可随需求回收
平台定价
平台级全球GA存储阈值QPM
🔎 事实与证据Google Cloud 7 月 23 日更新 Agent Search 可配置定价:客户现在可以降低存储规模和每分钟查询数(QPM)的订阅阈值,此前只能上调;降低后的配置在下一计费周期开始生效。该能力已正式可用,产品正从 Vertex AI Search 更名为 Agent Search。
🏢 影响与用户可下调容量减少企业搜索试点或季节性业务的锁定成本,也让 Agent 检索层更接近可伸缩基础设施。平台团队应把峰值 QPM、索引规模和下一周期生效延迟纳入容量治理;这不是按秒弹性缩容,也不改变检索质量与数据治理责任。
关键节点:订阅阈值从“只能升”变为“可升可降”。风险边界:变更按计费周期生效,不能代替实时自动扩缩容。
飞书 aily 升级为可主动工作的团队 Agent:支持共享智能体、多智能体协同与 7×24 云端执行
企业 Agent
产品级中国主动工作多 Agent权限治理
🔎 事实与证据飞书 aily 7 月 23 日增加主动跟进、团队共享智能体和多智能体协同,可在授权范围使用消息、文档、日历、会议、任务与多维表格,并调用浏览器执行任务。产品可在云端持续运行,生成文档、表格、演示、网页和应用,管理员可统一查看来源、负责人、状态和权限。
🏢 影响与用户办公套件利用已有上下文和权限,把 Agent 从独立聊天窗口嵌入实际组织工作流,对通用 Agent 和企业自动化平台形成分发压力。企业应先从可回滚、可审核任务试点,关注跨群数据、第三方 Agent、浏览器动作和输出代码的权限边界。
关键节点:共享 Agent + 多 Agent 分工 + 飞书内原位交付。风险边界:持续执行会放大误操作,权限、审批和人工复核不能省略。
OpenForgeRL 开源:以代理与 Kubernetes 隔离容器训练 Codex、OpenClaw 等真实 Harness Agent
开源框架
开发者级全球RLKubernetesHarness-native
🔎 事实与证据7 月 23 日提交的 OpenForgeRL 提出开放式 Harness 原生训练框架:轻量代理接管并记录 Claude Code、Codex、OpenClaw 等 Harness 的模型调用,再把轨迹交给 veRL 等标准 RL 栈;Kubernetes 编排器让每个 rollout 在独立远程容器执行,覆盖工具 Agent 与 GUI Agent。
🏢 影响与用户框架试图把模型训练和真实 Agent 执行环境解耦,降低状态化、多进程 Harness 无法进入现有 RL 栈的门槛。研究和平台团队可据此比较不同 Harness 的可训练性;当前证据主要来自论文实验,错误恢复仍被作者列为弱项,生产运维成本也未验证。
关键判断:训练对象从模型策略扩展到真实 Harness 行为。风险边界:论文开源声明不等于成熟产品,复现、资源需求与安全隔离需独立验证。