Claude Opus 5
Anthropic 于 2026-07-24 发布的 Claude Opus 5(claude-opus-5):1M 上下文、128K 最大输出、$5/$25 每百万 token,adaptive thinking 默认开启,官方定位为长时间运行 Agent 的跨代升级;退役时间不早于 2027-07-24。
发布 2026-09-25更新 2026-09-25核实 2026-09-25规格
- 厂商
- Anthropic
- 发布日期
- 2026/7/24
- 类型
- coding
- 上下文窗口
- 1000K tokens
- 最大输出
- 128K tokens
- 定价
- 输入 $5 / 输出 $25 每百万 token(缓存读 $0.50、5 分钟缓存写 $6.25、1 小时缓存写 $10;Batch API 五折;Fast 模式约 $10/$50)
- API 兼容
- anthropic, bedrock, vertex-ai, azure-ai-foundry
基准测试
优势
- •1M 上下文 + 128K 最大输出(Batch API 用 output-300k-2026-03-24 头可到 300K)
- •官方定位「面向长时间运行 Agent 的跨代提升」,adaptive thinking 默认开启,默认 effort 为 high
- •定价与上一代 Opus 4.8 持平($5/$25),是同代 Fable 5 的一半
- •官方称通用访问无数据留存要求;退役时间不早于 2027-07-24,可放心写入长期方案
- •Claude API / Amazon Bedrock / Google Cloud / Microsoft Foundry 四处同名可用
不足
- •⚠️ breaking change:effort 为 xhigh / max 时 thinking: {type: disabled} 返回 400(Opus 4.8 允许),旧代码需改
- •官方基准全部为 Anthropic 自报(Frontier-Bench v0.1、ARC-AGI-3、Zapier AutomationBench 等),无第三方独立复现
- •官方自述在网络安全漏洞利用开发上「明显落后」于 Mythos 5,护栏与 Opus 4.8 大体相当
- •知识截止 2026-05,晚于此的事件需要外部检索补
- •国内无官方 API 通道
适用场景
概述
Claude Opus 5(模型 ID claude-opus-5)是 Anthropic 于 2026 年 7 月 24 日发布的 Opus 档旗舰,官方措辞是 「a step change improvement for the Opus tier powering long-running agents」——为长时间运行的 Agent 而做的跨代提升,不是为单轮对话质量做的优化。
三个最值得先记住的事实:
- 定价与上一代持平:$5 / $25 每百万 token,与 Opus 4.8 相同,而只有同期 Claude Fable 5 的一半($10/$50)。
- 退役时间明确:官方模型总览页写明 not sooner than July 24, 2027——这是把它写进长期方案的安全依据。
- 有一处 breaking change:
effort为 xhigh / max 时,thinking: {"type": "disabled"}会返回 400(Opus 4.8 允许)。从 4.x 升级的代码要改这一行。
它在家族里处在「中间偏上」的位置:比 Sonnet 5 强、比 Fable 5 便宜,而 2026-09-22 的 Claude Opus 5.5 发布后,Opus 5 又成了官方对比表里被反复引用的成本与能力基线——这也是本卡存在的意义:看 5.5 的「降 40%」「提 14 分」这类说法时,需要知道基线是谁。
官方规格(2026-09-25 核对)
| 项 | 值 |
|---|---|
| 模型 ID | claude-opus-5(Bedrock:anthropic.claude-opus-5;Google Cloud / Microsoft Foundry:claude-opus-5) |
| 上下文窗口 | 1M token |
| 最大输出 | 128K token(Batch API 配 output-300k-2026-03-24 头可到 300K) |
| 输入 / 输出 | $5 / $25 每百万 token |
| 缓存读 | $0.50 / MTok |
| 缓存写 | 5 分钟 $6.25 / 1 小时 $10(最小可缓存提示长度 512 token) |
| Batch API | 输入与输出均五折 |
| Fast 模式 | 约 2.5 倍速、两倍价(约 $10/$50) |
| Thinking | Adaptive,默认开启 |
| 默认 effort | high |
| 相对延迟 | Moderate(比 Sonnet 5 慢、比 Fable 5 快) |
| 知识 / 训练截止 | 2026-05 |
| 状态 | Active(latest) |
| 退役 | 不早于 2027-07-24 |
| 可用平台 | Claude API、Amazon Bedrock、Google Cloud、Microsoft Foundry |
同代家族横向(官方模型总览页口径)
| 模型 | 上下文 | 最大输出 | 价格 / MTok | 相对延迟 | Thinking | 默认 effort | 知识截止 |
|---|---|---|---|---|---|---|---|
| Claude Fable 5 | 1M | 128K | $10 / $50 | Slower | Adaptive(常开) | high | 2026-01 |
| Claude Opus 5 | 1M | 128K | $5 / $25 | Moderate | Adaptive | high | 2026-05 |
| Claude Sonnet 5 | 1M | 128K | $2 / $10 | Fast | Adaptive | high | 2026-01 |
| Claude Haiku 4.5 | 200K | 64K | $1 / $5 | Fastest | Extended | — | 2025-02 |
一处需要本站读者知道的口径冲突:官方模型总览页至今把 Claude Sonnet 5 列为 $2/$10;本站 Sonnet 5 卡此前按「促销价 2026-08-31 到期」推断已回升至 $3/$15,该推断缺乏官方依据,本站已按官方总览页口径更正。做预算请以 Anthropic 官方定价页为准。
thought / effort:本代最容易踩的一处变更
Opus 5 的 adaptive thinking 默认开启,默认 effort 为 high。与 Opus 4.8 相比有一处破坏性变更:
| 操作 | Opus 4.8 | Opus 5 |
|---|---|---|
| effort ≤ high 时关闭 thinking | 允许 | 允许 |
| effort 为 xhigh / max 时关闭 thinking | 允许 | 返回 400 |
实践含义:如果你的服务为了省 token 在低延迟路径上统一发 thinking: {"type":"disabled"},那么只要请求里同时带了 xhigh 或 max 的 effort,就会直接报错而不是降级。修法有两种——把 effort 降到 high 及以下,或者改用 effort 参数本身来控制推理深度(这也是官方推荐的做法)。
顺带一提,这条规则在 Opus 5.5 上变得更严格:5.5 完全不允许关闭 thinking,任何 effort 下发 disabled 都返回 400。
官方基准(均为 Anthropic 自报,谨慎引用)
| 基准 | 官方说法 |
|---|---|
| SWE-bench Pro | 79.2%(约上一代 Opus 的两倍) |
| Frontier-Bench v0.1 | 43.3%,称超过所有其他模型、比 Opus 4.8 翻倍以上 |
| ARC-AGI-3 | 30.2%,称约为次优模型的 3 倍 |
| CursorBench 3.2 | 与 Fable 5 最高分差距 0.5% 以内,成本约其一半 |
| OSWorld 2.0 | 超过 Fable 5 最佳结果,成本略高于其三分之一 |
| Zapier AutomationBench | 通过率为次优模型的 1.5 倍 |
| 有机化学 / 蛋白功能预测 | 分别 +10.2 / +7.7 个百分点(官方未点名对照模型) |
口径提醒:上表全部来自 Anthropic 自己的发布材料与自选测试,未见第三方独立复现。文中反复出现的 Fable 5、Mythos 5 属于 Anthropic 的内部参照系,不宜当作公认排名直接引用。这套数字的正确用法是看方向(长程 Agent 是主战场),而不是拿去和别家榜单横向比。
安全口径
- 官方称其为内部自动化行为审计下 「most aligned model to date」, deception 行为发生率是已测 Claude 模型中最低;
- 但同时承认在网络安全漏洞利用开发上**「substantially behind」Mythos 5**,护栏整体与 Opus 4.8 相当,仅在一小部分网络任务上更强;
- 官方称通用访问没有数据留存要求(no data retention requirements for general access),这是企业采购时的关键条款。
API 调用示例
from anthropic import Anthropic
client = Anthropic(api_key="sk-ant-...")
resp = client.messages.create(
model="claude-opus-5",
max_tokens=32000,
# effort 保持 high 或以下时,才允许显式关闭 thinking
thinking={"type": "disabled"},
messages=[
{"role": "user", "content": "列出这个仓库里所有未校验来源的 pickle.load 调用"},
],
)
print(resp.content[-1].text)
走 Batch API 拿五折时,若需要超过 128K 的输出,请加
output-300k-2026-03-24beta 请求头(上限 300K)。
适合 / 不适合
适合
- 数小时级、跨多步的自主 Agent 任务——这是官方明确的主攻方向;
- 大型代码库的端到端改造与审查(SWE-bench Pro 79.2%);
- 对延迟不敏感、但对单次要装下整个仓库有要求的批量任务(1M 上下文 + Batch 五折 + 300K 输出);
- 需要明确保留周期与退役时间表的企业选型(退役不早于 2027-07-24)。
不适合
- 已经在用 Opus 5.5 的新项目:5.5 更便宜($4/$20,缓存读 $0.20)且在编程基准上更高,Opus 5 主要作为成本/能力基线与保守迁移目标存在;
- 低延迟交互式补全:Haiku / Sonnet 档更快且便宜一个量级;
- 国内裸跑:无官方通道;
- 晚于 2026-05 的事实性问题:知识截止在那,必须配外部检索。
避坑清单
- xhigh / max + 关闭 thinking = 400:这是从 4.x 升级最常见的报错,见上文专节。
- 别把官方基准当跨厂商排名:全部自报、未见独立复现,且参照系(Fable 5 / Mythos 5)是 Anthropic 自家模型。
- 缓存最小长度 512 token:低于该长度的提示不会被缓存,短请求的缓存策略算不进成本模型。
- 1 小时缓存写比 5 分钟贵 60%:只在「一小时内会重复读取」的会话里才划算,别默认选 1h。
- Fast 模式是两倍价:只给真正卡延迟的关键路径开,否则会抵消掉 $5/$25 的性价比。
FAQ
Opus 5 和 Opus 5.5 该怎么选? 新项目直接上 Opus 5.5:更便宜、编程基准更高、缓存读降 60%。Opus 5 的价值在于退役时间明确(不早于 2027-07-24)且生态验证更久,适合不愿意跟随季度换代的 conservative 部署。
为什么本站要为已经「过时」的模型建卡? 因为 Opus 5 是官方与媒体对比表里最常被引用的基线(「比 Opus 5 便宜 40%」「比 Opus 5 高 14 分」)。没有这张卡,读者无法判断那些相对数的真实含义。
1M 上下文是默认值还是最大值? 官方总览页标注为 1M(both default and maximum)——默认就是最大值,不需要额外开启。
延伸阅读
- 同门:Claude Opus 5.5 · Claude Sonnet 5 · Claude Fable 5.1 · Claude Opus 4.5 · Claude Haiku 4.5
- 对手:GPT-6 Astra · GPT-5.6 · Grok 4.7
- 工具:Claude Code · Cline · Cursor · OpenRouter
- 概念:Agentic Coding · 长上下文 · 推理模型 · Prompt Caching
来源
- Claude Opus 5 官方模型总览(platform.claude.com,规格与定价的唯一权威来源)
- Claude Platform 版本说明 / developer newsletter(Anthropic,2026-07-24 Opus 5 发布条目)
- Claude Opus 5: What Anthropic's New Model Changes(Next AI Compare,2026-07,对官方自报基准的整理与免责说明)
本卡片由 AI 之家 编辑部根据公开资料整理,非厂商付费内容。规格与定价以 Anthropic 官方模型总览页为准;基准数字均为 Anthropic 自报、无第三方独立复现,引用时请注明口径。欢迎在 反馈邮箱 反馈更新。
相关工具
Aider vs Claude Code:终端 AI 编程双雄怎么选
Aider vs Claude Code 2026 选型对比:开源 BYOK 多模型 vs Anthropic 订阅长任务 Agent,从编程能力、多模型支持、价格、Git 集成、国内可用性和适合人群判断,帮你选对终端 AI 编程工具。
Cursor vs Aider:GUI IDE 还是 CLI?2026 对比
Cursor vs Aider 2026 选型对比:GUI IDE vs Git 原生 CLI,从 Composer vs Architect 双模型、Tab 补全、多模型 BYOK、价格计费、开源与否和适合人群判断,帮开发者选对。Cursor 是闭源 VS Code fork 月费 $20,Aider 是开源 Apache-2.0 CLI 自带 API key。
Augment Code vs Cursor:企业 AI 编程怎么选?Context Engine vs AI IDE 对比
Augment Code vs Cursor 2026 选型对比:Context Engine 全仓索引的企业 AI 平台 vs SpaceX 收购的 AI IDE 天花板,从形态、Context 覆盖、长任务、价格、合规、中文支持和适合人群 8 个维度判断,帮你选对企业 AI 编程工具。
Claude Code vs Cline:CLI AI Agent 怎么选?2026 对比
Claude Code vs Cline 2026 选型对比:Anthropic 官方闭源 CLI Agent vs Apache-2.0 开源 VS Code 插件。从模型绑定、工作流、MCP 支持、价格、隐私和适合人群 6 个维度帮你选对 CLI AI 编程工具。
Claude Code vs Codex CLI:终端 AI Agent 双雄对比
Claude Code vs Codex CLI 2026 选型对比:Anthropic 与 OpenAI 两大官方终端 Agent 的模型、长任务、MCP 生态、Windows 支持、订阅打包价格和国内可用性全方位对比,帮你判断该用哪个终端 AI Agent,以及能不能两个一起用。
Claude Code vs Crush:Anthropic 官方 vs 多模型 TUI(2026 实测选型)
Claude Code vs Crush 2026 选型对比:Anthropic 官方 CLI Agent(Claude only + 长任务最稳 + MCP 一等公民)vs Charmbracelet 开源 TUI Agent(多模型 mid-session 切换 + LSP + FSL-1.1-MIT)。从模型、长任务、生态、价格、国内可用性帮你选对终端 AI 编程工具。