Kimi K3
Kimi 是月之暗面(Moonshot AI)的旗舰模型系列。最新 Kimi K3 为 2.8T 开源权重、1M 上下文,Arena.ai 编程榜全球第一。本文评测其编程能力、定价与自托管价值,帮你判断是否值得用。
发布 2026-07-20更新 2026-09-20核实 2026-09-20规格
- 厂商
- 月之暗面
- 发布日期
- 2026/7/17
- 类型
- coding
- 上下文窗口
- 1000K tokens
- 最大输出
- 64K tokens
- 定价
- 混合价约 $2.3/M(输入 ¥20/M · 输出 ¥100/M)
- API 兼容
- openai, moonshot
基准测试
优势
- •Arena.ai 编程榜全球第一
- •2.8T 参数,当前最大开源中文大模型
- •1M 上下文,reasoning + vision 全能
- •权重将于 2026-07-27 前公开,可自托管
- •首创 Kimi Delta Attention + Attention Residual 架构
不足
- •API 混合价 $2.3/M 为中国模型最高档
- •2.8T 参数自托管部署成本高
- •综合智能指数(57)略低于 GPT-5.6 Sol / Gemini 3.1 Pro
- •生态与工具集成仍在完善
适用场景
2026-09 更新:K3 的产业地位在这一周期里被三件事坐实。其一,Cognition 于 2026-09-10 发布的编程模型 SWE-2 正是以 K3(2.8T)为后训练基座(详见资讯:Cognition SWE-2 发布),Cognition 称在此之上仍找到 5–6 分提升空间。其二,月之暗面于 2026-09-11 把 Kimi K2.8 Preview 全量上线 Kimi Code / Kimi Work,Model ID 仍为
kimi-for-coding、1M 上下文下放到全部会员档位(详见资讯:K2.8 Preview 全量上线)——K3 与主力档的能力差被压缩到两个月以内。其三,K3 已于 2026-09-18 正式登陆 Amazon Bedrock(海外区域,详见资讯:Kimi K3 上线 Bedrock),成为 Bedrock 上首个支持显式 Prompt Caching 的开放权重模型,与专有模型共用同一套访问、加密与审计管控——海外区企业级分发通道打通,受监管行业「前沿编程能力 + 数据不出 AWS 边界」首次同时成立。选型提示:追求极限深度推理仍看 K3,跑量日常任务可考虑 K2.8;海外企业客户可优先评估 Bedrock 托管通道。
概述
Kimi K3 是月之暗面于 2026 年 7 月 17 日发布的旗舰模型,也是当前参数量最大的开源中文大模型(2.8T 参数),1M 上下文,支持 reasoning 与 vision。它在 Arena.ai 编程对战榜上排名全球第一,Artificial Analysis 综合智能指数 57,位列全球第三(仅次于 GPT-5.6 Sol、Gemini 3.1 Pro)。
Kimi K3 把「开源」和「最强」两个标签同时贴到了一个中文模型上——模型权重将于 2026-07-27 前全部公开,意味着开发者第一次能够自托管一个编程能力接近顶级闭源模型的权重。
核心能力
编程登顶
| 维度 | Kimi K3 |
|---|---|
| Arena 编程榜 | 全球第一 |
| AA 智能指数 | 57(全球第三) |
| 参数量 | 2.8T(开源权重) |
| 上下文 | 1M |
| 能力 | reasoning + vision |
在 Arena.ai 的编程对战榜上,它压过了一众闭源前沿模型排到第一,综合智能指数也稳居全球第三。
架构创新
Kimi K3 首创 Kimi Delta Attention + Attention Residual 架构,专门提升长上下文场景下的注意力效率,这也是它能在 1M 上下文里保持稳定表现的关键。
开源权重的价值
对企业与政府客户,「权重可自托管」解决了三个刚需:数据不出域、成本可控、可深度微调。K3 的到来,加上 GLM-5.2、Qwen3.7,让 2026 下半年的中文开源阵营在编程赛道具备了与闭源正面竞争的实力。
API 调用示例
from openai import OpenAI
client = OpenAI(api_key="sk-...", base_url="https://api.moonshot.cn/v1")
resp = client.chat.completions.create(
model="kimi-k3",
messages=[{"role": "user", "content": "为这个仓库设计一套单元测试"}],
)
print(resp.choices[0].message.content)
定价
| 项目 | 价格 |
|---|---|
| 输入 | 约 ¥20/M |
| 输出 | 约 ¥100/M |
| 混合价 | 约 $2.3/M(中国模型最高档) |
价格是中国模型里的最高档,但对标其全球第一的编程能力仍具竞争力;若自托管开源权重,长期成本可进一步压低。
与同档模型怎么选
| 维度 | Kimi K3 | GLM-5.2 | DeepSeek V4-Pro |
|---|---|---|---|
| 参数 | 2.8T | 754B | 1.6T |
| 开源权重 | 7-27) | 部分 | |
| 编程 | Arena 第一 | AA 开源第一 | 强 |
| API 价 | $2.3/M | $1.40/$4.40 | ~$1.74/$3.48 |
| 上下文 | 1M | 1M | 1M |
建议:对编程能力要求最高、且有算力自托管的团队选 Kimi K3;预算敏感选 DeepSeek V4;要平衡能力与开源生态选 GLM-5.2。
避坑清单
- API 价不便宜:$2.3/M 是中国模型最高档,高频场景用 DeepSeek V4 更省。
- 自托管成本高:2.8T 参数的推理服务对算力要求极高,中小团队用官方 API 更务实。
- 等权重公开:计划自建的团队可等 7-27 权重全部公开后再评估。
FAQ
Q: Kimi K3 值得自托管吗? A: 对有算力、重数据合规的团队非常值得——7-27 权重公开后,可自建一个编程能力接近顶级闭源模型的推理服务,数据不出域且可深度微调。但 2.8T 参数的部署成本不低,中小团队用官方 API($2.3/M)仍是更务实的路径。
Q: 它和 DeepSeek V4 怎么选? A: 追求最强编程能力选 Kimi K3(Arena 第一);追求极致性价比选 DeepSeek V4-Flash($0.14/$0.28)。K3 赢在能力天花板,V4 赢在单位成本。
Q: 权重什么时候能下载? A: 官方计划 2026-07-27 前全部公开,延续 Moonshot 的开源路线。
延伸阅读
- 对比同档:DeepSeek V4 / GLM-5.2 / Qwen3-Coder
- 相关模型:Kimi K2 Thinking / Kimi K2
- 相关资讯:Kimi K3 发布 / Kimi K3 上线 Amazon Bedrock
相关工具
Cursor vs Aider:GUI IDE 还是 CLI?2026 对比
Cursor vs Aider 2026 选型对比:GUI IDE vs Git 原生 CLI,从 Composer vs Architect 双模型、Tab 补全、多模型 BYOK、价格计费、开源与否和适合人群判断,帮开发者选对。Cursor 是闭源 VS Code fork 月费 $20,Aider 是开源 Apache-2.0 CLI 自带 API key。
Augment Code vs Cursor:企业 AI 编程怎么选?Context Engine vs AI IDE 对比
Augment Code vs Cursor 2026 选型对比:Context Engine 全仓索引的企业 AI 平台 vs SpaceX 收购的 AI IDE 天花板,从形态、Context 覆盖、长任务、价格、合规、中文支持和适合人群 8 个维度判断,帮你选对企业 AI 编程工具。
Cursor vs Claude Code:什么时候用哪个?(2026 实测选型)
Cursor 和 Claude Code 到底怎么选?一句话结论 + 决策树 + 价格实测 + 国内可用性对比。GUI 派选 Cursor,终端长任务派选 Claude Code,最优解其实是共存。
GitHub Copilot vs CodeBuddy:国内团队怎么选?2026 对比
GitHub Copilot 与腾讯 CodeBuddy 2026 选型对比:一个胜在生态覆盖与编辑器支持最广,一个胜在中文语境与国内直连。从产品形态、上手成本、长任务、价格与国内可用性 6 个维度给出明确取舍建议。
GitHub Copilot vs Cody:日常补全还是大型代码库理解?2026 对比
GitHub Copilot 与 Sourcegraph Cody 2026 选型对比:Copilot 胜在补全覆盖与生态最广,Cody 胜在大型代码库的代码搜索与跨仓库上下文检索。从产品形态、上手成本、长任务、价格与国内可用性给出明确取舍。
Cursor vs GitHub Copilot:AI IDE 还是插件?2026 对比
Cursor vs GitHub Copilot 2026 选型对比:AI 原生 IDE vs IDE 插件,从 Composer vs Agent Mode、Tab 补全、多模型、AI Credits 计费、企业版和适合人群判断,帮开发者选对。Cursor 是 VS Code fork 重写交互层,Copilot 是 VS Code 插件继承原生体验。两家都已切 usage 制。