
Anthropic 在 2026 年夏天的密集发布:从 Opus 5 到 5.2 与 Mythos 5
Anthropic 在 2026 年 7-8 月连续放出三档模型:Opus 5(7 月 25 日)、5.2(8 月 5 日)、Mythos 5(8 月中旬)。三档模型不是简单的能力阶梯,而是给”成本/上下文/推理深度”三维定价空间重新切了线——很多过去在 Sonnet 4.5 上做的工作,现在可以更便宜或更聪明地完成。
Opus 5:把最强档从”必须按月订阅”挪到”按调用付费”
Opus 5 的最大变化不是能力,而是计费路径。从 4.x 系列开始,Anthropic 把 Opus 档定位为”研究型”模型,只在 enterprise contract 里以 reserved capacity 方式提供;独立开发者和中小团队没有工程化的调用路径。Opus 5 在 7 月底转向按 token 计费,输入 15 美元、输出 75 美元每百万 token,价格和 Sonnet 4.5 的 3/15 美元大致是 5x 关系。
这个改动对应的真实需求:大量原本要靠 Sonnet 4.5 + 长上下文 trick 才能勉强完成的”难任务”(复杂代码生成、法律/医学多文档交叉核对、数学证明),现在可以直接交给 Opus 5,不用再做 prompt 工程的边际优化。VentureBeat 在报道里引用的一个测试用例是把 Opus 5 用来跑 8 万行代码库的迁移重写,首次通过率从 Sonnet 4.5 的 62% 提升到 79%。
- 长链推理窗口:Opus 5 在内部 benchmark 上能稳定连贯完成 24 步以上的工具调用而不退化,Sonnet 4.5 在第 16 步附近开始出现指令遗忘。
- 代价是延迟:同档输入下,Opus 5 的 P95 延迟比 Sonnet 4.5 高 2.1 倍,在交互式场景里用户能明显感知。
怎么用 Opus 5 才划算?把它放在”重路径”上,而不是替代 Sonnet 4.5:典型的 hybrid 调度是 Sonnet 4.5 做日常 Agent 的执行链路(主力调用),Opus 5 做关键的代码 review、设计评审、子规划等”低频高质”任务。
5.2:Workflow 导向的”工作流模型”
5.2 的发布博客(via techdailyshot)把它描述为”Workflow Upgrades”,这是 Anthropic 第一次给模型档位明确加上”工作流”标签。技术上,5.2 比 Opus 5 更靠近 Sonnet 系列(延迟接近 Sonnet 4.5,价格略高于 Sonnet 4.5,但远低于 Opus 5)。它的设计目标是在多步骤、长记忆、强约束的企业工作流里提供”专家级”行为,但不付出 Opus 5 的等待时间。
5.2 真正值得开发者注意的两点:
workflow_schema协议:允许在 prompt 里直接声明流程图节点,模型在执行过程中会自动检查是否按节点推进,跳过”自觉合理但违背工作流”的偏离。例如,一个合同审批流里要求”必须先看金额再看法务”,5.2 在中间推理即使”看着金额已经合理”,仍会强制读法务条款。- 会话内”工作流记忆”:5.2 在 64K 之内的会话历史里可以保留节点级状态,跨调用恢复,这与 Sonnet 4.5 的 1M 长上下文是不同的优化方向——5.2 关心”我执行到流程的哪一步”,而不是”我读过什么”。
5.2 适合的场景是任何”有明确流程图”的工作:审批、巡检、SOP、报送。如果你的应用本来就是”Agent 自主决策”,5.2 反而会显得僵硬;但只要流程里有”必须做某件事”的硬约束,5.2 比 Sonnet 4.5 节省 40% 以上的人工兜底。
Mythos 5:面向科研的”长程推理”模型
Mythos 5 在 8 月中旬悄悄开放,目标用户是科研团队。它与 Opus 5 的差异不是”更强”而是”更持久”:Opus 5 单次会话内可以高强度工作,Mythos 5 设计成跨多日、多会话的任务继续推进。Anthropic 给 Mythos 5 提供了一个独立的 citation 库,允许把模型在历史上读过的论文和章节都纳入下一轮推理。
这一档位对绝大多数工程师不直接相关(它主要面向 OpenAI Deep Research、Anthropic Project Genie 这类深度研究类应用),但如果你的产品里有”持续数小时的研究型 Agent”,Mythos 5 是当前唯一在公开 API 里能跑完一周而不出错的模型。
Claude Code 额度翻倍的工程含义
伴随 5.2,Anthropic 还把 Claude Code 的企业额度上限翻倍。这意味着大企业的 IDE 集成与 IDE-orchestrated Agent 可以跑更多任务而不用做月度归零。短期看,这一改动不是技术升级,是商业承诺:Anthropic 在与 Cursor、Cognition 这类 IDE-embedded Agent 厂家的合作上加大了让步,反映出 Claude Sonnet 在编程 Agent 赛道上面临的实际压力。
挑选 5 系列的策略建议
简单版的混合策略:
- Sonnet 4.5:日常 Agent 主调用,占 60%。(参考 8 月发布的开放策略)
- 5.2:工作流型场景(审批、巡检、SOP),占 25%。
- Opus 5:低频高质任务(代码 review、长文档核对),占 10%。
- Mythos 5:科研/持续研究型 Agent,占 5% 以下。
这套组合在 2026 年 8 月是相对稳定的”现状”。Anthropic 用 7-8 月两个月把”档位”从原本的 Haiku/Sonnet/Opus 三档,扩成 4 档+1 科研档,对开发者的真实含义是:不要再用 Sonnet 4.5 一个模型扛所有事,把业务拆到合适档位上既省钱又提升质量。Opus 5 按时计费是关键拐点——研究型用例不再是”reserved contract”门槛,小团队也用得起。



