跳到主内容
codingAnthropic

Claude Sonnet 5

Anthropic 2026 年 6 月 30 日发布的 Claude Sonnet 5,1M 上下文,SWE-bench Verified 85.2%,现为 claude.ai 默认模型,促销期定价 $2/$10。

发布 2026-07-20更新 2026-09-30核实 2026-09-30

规格

厂商
Anthropic
发布日期
2026/6/30
类型
coding
上下文窗口
1000K tokens
最大输出
128K tokens
定价
$2/$10 每百万 token(官方模型总览页口径;此前「促销到期回升至 $3/$15」的推断缺乏官方依据,2026-09-25 已更正)。⚠️ 2026-09-28 起 Anthropic API 的默认 Sonnet 已切换为同价的 Sonnet 5.5,本卡转为上一代
API 兼容
anthropic, bedrock, vertex-ai

基准测试

85.2%
SWE-bench Verified
63.2%
SWE-bench Pro
80.4%
Terminal-Bench 2.1
81.2%
OSWorld-Verified
1618 Elo
GDPval-AA v2

优势

  • •SWE-bench Verified 85.2%,编程能力第一梯队
  • •1M 上下文(batch beta 可到 300K 输出)
  • •曾为 claude.ai Free & Pro 默认模型,普及度高(**2026-09-28 起 API 默认 Sonnet 已切换为同价的 Sonnet 5.5**)
  • •$2/$10 的中端档,曾是日常编程主力(官方模型总览页口径;2026-09-28 起同价位已有更强的 Sonnet 5.5)
  • •首个内置实时网络安全防护的 Sonnet,默认开启 adaptive thinking

不足

  • •新分词器令同文本 token 数约 +30%,需重新核算成本
  • •国内无官方 API,需走中转
  • •⚠️ 2026-09-28 起已被同价的 Sonnet 5.5 取代为 API 默认 Sonnet:新项目若仍写 `claude-sonnet-5`,是在主动放弃 30%+ 速度与更低的每任务 token
  • •⚠️ 定价口径曾有反复:本站此前按「促销到期」推断为 $3/$15,但官方模型总览页至今仍列 $2/$10,2026-09-25 已按官方口径更正
  • •多模态仅支持图片,弱于 Gemini

适用场景

软件工程 / SWE-bench 类代码修复大型 codebase 分析(1M 上下文)日常编程主力(性价比高)需要安全防护的企业场景

2026-09-30 更新(继任者已发布,本卡定位转为「上一代」):Anthropic 已于 2026-09-28 发布 Claude Sonnet 5.5(模型 ID claude-sonnet-5-5),Claude 5.5 家族第二款。定价与上下文完全不变($2/$10、缓存读 $0.20、1M 上下文),官方称输出提速 30%+ 且同任务更省 token,并即日成为 Anthropic API 上默认的 Sonnet 模型。这意味着:

  • 走「默认 Sonnet 别名」的调用已被静默切到 5.5——没显式写 claude-sonnet-5 的代码,实际用的已经不是本卡描述的模型;
  • 本卡(Sonnet 5)从「当前主力」变为「上一代」,新项目请以 Sonnet 5.5 为基线做对照 eval;
  • 家族第三款 Haiku 5.5 仍未发布(路透社 2026-09-28 报道称「即将推出」,官方未给日期)。

详见 Claude Sonnet 5.5 发布资讯。本卡正文保留 Sonnet 5 的原始事实,不再按新口径改写。

2026-09-24 更新(促销到期 + 家族换代,本卡部分内容已过时):三件事。

其一(定价口径更正,2026-09-25):本卡此前引用 促销价 $2/$10 有效期至 2026-08-31,并据此推断到期后回升至标准价 $3/$15。该推断缺乏官方依据——Anthropic 官方模型总览页至今仍将 Sonnet 5 列在 $2/$10,未见任何调价公告。本卡已按官方口径更正为 $2/$10,并撤回原先的推断结论。教训很实在:「条款到期」不等于「价格变了」,按条款推断出来的价格不能写进 frontmatter。 做预算仍请以 Anthropic 官方定价页为准。

其二(家族换代):Anthropic 已于 2026-09-22 发布 Claude Opus 5.5(Claude 5.5 家族首款,$4/$20,缓存读 $0.20,官方称典型负载成本比 Opus 5 低约 40%),并预告 Claude Sonnet 5.5 与 Claude Haiku 5.5 将在未来数周跟进。本卡(Sonnet 5)即将被 Sonnet 5.5 取代,采购与选型请把这条时间线算进去。

其三(同价位竞争加剧):OpenAI 同日发布的 GPT-6 Sol 定价 $2/$10,与 Sonnet 5 原价持平——Sonnet 5 的性价比优势已被抹平,新项目建议直接做 Sonnet 5 vs GPT-6 Sol 的对照 eval,不要按旧印象选型。

概述

Claude Sonnet 5(模型 ID claude-sonnet-5)是 Anthropic 于 2026 年 6 月 30 日发布的新一代主力模型。1M 上下文、128K 输出(batch beta 可到 300K),知识截止 2026 年 1 月。它现已成为 claude.ai Free & Pro 的默认模型,并同步上线 Claude Code、API、Cursor、VS Code、GitHub Copilot。

它是首个内置实时网络安全防护的 Sonnet,默认开启 adaptive thinking,在保持高性价比的同时把编程能力推到 SWE-bench Verified 85.2%。

核心能力

编程第一梯队

  • SWE-bench Verified 85.2%、SWE-bench Pro 63.2%
  • Terminal-Bench 2.1 80.4%、OSWorld-Verified 81.2%
  • HLE(w/tools) 57.4%、GDPval-AA v2 1618 Elo

85.2% 的 SWE-bench Verified 让它在纯代码修复任务上接近甚至超过部分旗舰模型,而价格只是旗舰的零头。

1M 上下文 + adaptive thinking

默认开启 adaptive thinking,模型会根据任务难度自动决定思考深度。1M 上下文足以塞入中大型 codebase 的全量代码,配合 Claude Code 做全仓分析非常顺手。

内置安全防护

Sonnet 5 是首个内置实时网络安全防护的 Sonnet,在企业场景下对提示注入、恶意代码生成等风险有更强的默认防御。

API 调用示例

import anthropic
client = anthropic.Anthropic(api_key="sk-ant-...")

msg = client.messages.create(
    model="claude-sonnet-5",
    max_tokens=8000,
    messages=[{"role": "user", "content": "定位并修复这个测试失败"}],
)
print(msg.content[0].text)

定价

项目促销价(至 2026-08-31)标准价
Input$2/M$3/M
Output$10/M$15/M
Cache$0.20/M—

注意 5 换用了新分词器,同样的文本 token 数约增加 30%,核算成本时不能只看单价,要按实际 token 量估算。

与同档模型怎么选

维度Claude Sonnet 5GPT-5.6 TerraGemini 3.5 Flash
编程(SWE-bench)85.2%强中
上下文1M1.1M1M
促销单价$2/$10$2.50/$15$1.50/$9
安全防护内置标准标准
国内可用

建议:纯代码修复、日常编程主力选 Sonnet 5(性价比 + SWE-bench 双优);终端 Agent 选 GPT-5.6;极致低价选 DeepSeek V4。

避坑清单

  • 算 token 别只看单价:新分词器令 token 数 +30%,实际成本比单价看起来高。
  • 别替厂商推断价格:本站曾据「促销 $2/$10 到 2026-08-31」推断到期后回 $3/$15,但官方总览页至今仍列 $2/$10,该推断已撤回(2026-09-25)。做预算只认官方定价页,不认条款推断。
  • 1M 上下文按需用:超长上下文单次成本高,别无脑全塞。
  • 国内无直连:走 Bedrock / Vertex / 中转。

实际使用体验

日常编程主力,性价比是最大杀器。在 Cursor / Claude Code 里跑中等规模修改,Sonnet 5 的代码质量已接近旗舰 Opus,而账单只有零头。SWE-bench Verified 85.2% 不是纸面数字——在真实的「读报错 → 定位 → 修复 → 自测」循环里,它一次通过的比例明显高于上一代 Sonnet 4.5。

促销期是上车的最好时机。$2/$10 的定价配合 1M 上下文,几乎是 2026 年中最划算的前沿编程模型。但要记得新分词器让 token 数涨了约 30%,实际每次调用比账面贵一点,做预算时要留余量。

FAQ

Q: Sonnet 5 和 Opus 4.8 怎么选? A: 短任务、日常编程、成本敏感选 Sonnet 5;30 分钟以上长程 Agent、复杂多文件重构、需要极致能力的场景选 Opus 4.8。多数团队用 Sonnet 5 主力 + Opus 兜底难任务的混合策略最划算。

Q: 新分词器对成本影响多大? A: 同样的文本,token 数约增加 30%。也就是说即便促销价 $2/$10 看起来比标准价低,实际每次调用的 token 消耗比旧模型多,核算时要按实际 token 量而非字符数估算。

Q: 国内怎么用? A: 官方 API 不直供国内,走 AWS Bedrock、Google Vertex AI 或 OpenRouter 等中转。

延伸阅读

相关对比

Aider vs Claude Code:终端 AI 编程双雄怎么选

Aider vs Claude Code 2026 选型对比:开源 BYOK 多模型 vs Anthropic 订阅长任务 Agent,从编程能力、多模型支持、价格、Git 集成、国内可用性和适合人群判断,帮你选对终端 AI 编程工具。

Cursor vs Aider:GUI IDE 还是 CLI?2026 对比

Cursor vs Aider 2026 选型对比:GUI IDE vs Git 原生 CLI,从 Composer vs Architect 双模型、Tab 补全、多模型 BYOK、价格计费、开源与否和适合人群判断,帮开发者选对。Cursor 是闭源 VS Code fork 月费 $20,Aider 是开源 Apache-2.0 CLI 自带 API key。

Augment Code vs Cursor:企业 AI 编程怎么选?Context Engine vs AI IDE 对比

Augment Code vs Cursor 2026 选型对比:Context Engine 全仓索引的企业 AI 平台 vs SpaceX 收购的 AI IDE 天花板,从形态、Context 覆盖、长任务、价格、合规、中文支持和适合人群 8 个维度判断,帮你选对企业 AI 编程工具。

Claude Code vs Cline:CLI AI Agent 怎么选?2026 对比

Claude Code vs Cline 2026 选型对比:Anthropic 官方闭源 CLI Agent vs Apache-2.0 开源 VS Code 插件。从模型绑定、工作流、MCP 支持、价格、隐私和适合人群 6 个维度帮你选对 CLI AI 编程工具。

Claude Code vs Codex CLI:终端 AI Agent 双雄对比

Claude Code vs Codex CLI 2026 选型对比:Anthropic 与 OpenAI 两大官方终端 Agent 的模型、长任务、MCP 生态、Windows 支持、订阅打包价格和国内可用性全方位对比,帮你判断该用哪个终端 AI Agent,以及能不能两个一起用。

Claude Code vs Crush:Anthropic 官方 vs 多模型 TUI(2026 实测选型)

Claude Code vs Crush 2026 选型对比:Anthropic 官方 CLI Agent(Claude only + 长任务最稳 + MCP 一等公民)vs Charmbracelet 开源 TUI Agent(多模型 mid-session 切换 + LSP + FSL-1.1-MIT)。从模型、长任务、生态、价格、国内可用性帮你选对终端 AI 编程工具。