跳到主内容
reasoningxAI

Grok 4.7

Grok 4.7 是 xAI 于 2026-09-12 发布的旗舰模型,参数规模 2.1 万亿(较 Grok 4.6 的 1.5 万亿 +40%),马斯克称其工程与科学推理优于所有同类模型、token 效率更高,并以 SpaceX 工程数据补充训练。⚠️ 截至 2026-09-16,xAI 未公开 4.7 的官方 model card、上下文窗口、基准套件与 API 定价,文档库最新条目仍为 grok-4.6,本卡参数与能力口径待核实。

发布 2026-09-16更新 2026-09-25核实 2026-09-25

规格

厂商
xAI
发布日期
2026/9/12
类型
reasoning
定价
⚠️ 待核实:截至 2026-09-16 官方未公开;前代 Grok 4.6 为 $2 / $6 每百万 token
API 兼容
openai, xai

基准测试

2.1 万亿(Grok 4.6 为 1.5 万亿,+40%)
参数规模
⚠️ 待核实:官方未公开(4.6 为 500K)
上下文窗口
⚠️ 待核实:无官方 model card 与基准套件
官方基准
AA 智能指数 61,领先 GPT-5.6 Sol,落后 Claude Opus 5 与 Fable 5
前代基线(4.6)

优势

  • •参数规模 2.1 万亿,较 Grok 4.6 的 1.5 万亿增长约 40%,是当前公开参数量最大的前沿模型之一
  • •官方口径主打工程与科学推理,并以 SpaceX 真实工程数据做补充训练强化真实世界工程任务
  • •马斯克称 token 效率高于前代(服务速度略慢,单位 token 产出更优)
  • •延续 Grok 系列的性价比路线,前代 4.6 定价维持 $2/$6

不足

  • •⚠️ 无官方 model card、基准套件、上下文窗口与定价页,能力数据全部来自创始人陈述
  • •xAI 文档库(docs.x.ai)截至发布当周仍只列到 grok-4.6,无可用 API model ID
  • •马斯克自述多模态表现仍需改进;RL 阶段过度惩罚响应长度导致过早放弃困难任务
  • •国内无官方 API,需经第三方网关或代理,稳定性与合规性自负
  • •迭代过快(4.5→4.6→4.7 不到三个月),为单代做深度调优的投入回收周期极短

适用场景

工程与科学推理类任务(官方主推方向,待独立评测验证)成本敏感的批量 Agent 调用(需等定价公开后重新核算)作为多模型路由中的规模档备选(与 Fable 5.1 / Astra 做同任务对比)

数据可信度提示(务必先读):截至 2026-09-16,xAI 未公开 Grok 4.7 的官方 model card、上下文窗口、基准套件与 API 定价,官方模型文档最新条目仍为 grok-4.6。本卡的参数规模与能力表述来自马斯克本人在 X 的公开陈述及多家行业日报汇总,不属于官方文档口径。接入与迁移请以 xAI 官方文档为准。

概述

Grok 4.7 是 xAI 于 2026-09-12 发布的旗舰模型,参数规模 2.1 万亿,较 Grok 4.6 的 1.5 万亿增长约 40%。

它的定位可以概括成一句话:用规模去补能力差。 前代 4.6 的独立评测基线是「AA 智能指数 61,领先 GPT-5.6 Sol,但仍落后 Claude Opus 5 与 Fable 5」——赢在单位成本,不是绝对天花板。4.7 把参数推到 2.1T,是 xAI 押注「规模即差距」的直接体现。

同期它也延续了 xAI 近期的激进节奏:4.5(7 月)→ 4.6(8 月)→ 4.7(9 月),不到三个月三次大版本迭代,4.8(2.5T)已排在紧随其后的日程上。

核心能力

工程与科学推理(官方主推)

马斯克的表述是:除服务速度略慢外,4.7 在工程与科学推理上「优于所有模型」。

配合「用 SpaceX 公司数据补充训练」这一动作,可以推断其能力建设方向是真实世界工程任务——火箭遥测、制造工艺、故障排查这类公开互联网几乎不存在的数据。

需要冷静看待的是:这类数据第三方无法验证,且其对应的航天/制造场景对绝大多数开发者的日常工作没有直接迁移价值。真正的检验标准仍是通用编程基准与 Agent 长任务表现,而这些数据目前都没有公开。

Token 效率

官方口径称 token 效率更高(以略慢的服务速度换取更高的单位 token 产出)。在没有定价的前提下,这一说法暂时无法换算成成本优势——效率提升与单价是两件事,只有定价公开后才能判断真实性价比。

上下文与多模态

  • 上下文窗口:官方未公开(前代 4.6 为 500K)。
  • 多模态:马斯克在发布前明确表示多模态表现仍需改进,属已知短板。

获取方式 / 定价

通道状态说明
xAI 官方 API待核实文档库最新条目仍为 grok-4.6,4.7 的 model ID 未公开
GitHub Copilot已接入(2026-09-22 起灰度)见下节;这是目前唯一无需自接 API 即可在编程工具里用上 4.7 的通道
OpenCode已接入(v1.18.32,2026-09-21)开源终端 Agent 同版本一并加入 DeepSeek V4.1-Flash
第三方聚合网关需等待同步通常在官方接入后同步,建议通过网关做灰度切换
国内直连无官方通道需经第三方网关或代理,稳定性与合规性自负
定价未公开前代 Grok 4.6 为 $2 / $6 每百万 token

2026-09-25 补记:4.7 先落到了编辑器里,而不是 API

这是本卡自发布以来最实质的一次变化,也推翻了上面「不建议生产环境迁移」里关于可达性的一半判断:

  • GitHub Copilot(2026-09-22):xAI 的 Grok 4.7 开始在 GitHub Copilot 灰度上线,覆盖 Pro / Pro+ / Max / Business / Enterprise 全部付费档,官方定位是「承接 Grok 4.6,聚焦 agentic coding 与多步复杂工作流」。
  • OpenCode(v1.18.32,2026-09-21):开源终端 Agent 同版本加入 Grok 4.7 与 DeepSeek V4.1-Flash,并顺手修了两处跨 provider 的问题——Bedrock 图片附件收窄到 Claude / Nova / Llama 4 三类模型(此前对不支持的 bedrock 模型也会尝试附图),以及 Together AI 的 streaming usage 上报。

怎么理解:xAI 这代延续了「先铺渠道、后补文档」的打法——文档与定价仍缺位,但模型已经能在主编程工具里选到。如果你的用量完全走订阅制工具(Copilot / OpenCode),4.7 现在就是可用的;只有在自建 API 调用的场景下,「等官方文档」这条建议依然成立。

Copilot 的 rollout 是渐进式的,账号间可能相差数天;且 Copilot 侧的模型版本不保证与 xAI 官方 API 同名同规格,引用时请写清「Copilot 中的 Grok 4.7」。

适合 / 不适合

适合

  • 已经在用 Grok 4.6 且成本结构依赖其低价优势的团队——等 4.7 定价公开后做一次同任务对比即可,切换成本低。
  • 需要公开参数量最大档位做对比实验的研究/评测场景。
  • 把 Grok 作为多模型路由中的规模档,与 Claude Fable 5.1、GPT-6 Astra 并行跑分。

不适合

  • 需要 SLA 与可预期成本的生产环境——定价、限流、上下文三项都未公开,无法做容量规划。
  • 强依赖多模态的场景——官方自述仍需改进。
  • 长程高难度 Agent 任务——马斯克自述 RL 阶段过度惩罚响应长度,导致模型「过早放弃它本可以完成的困难任务」,而这恰恰是 Agent 最关键的指标。
  • 国内合规要求严格的团队——无官方 API 通道。

与前代怎么选

维度Grok 4.6Grok 4.7
参数规模1.5 万亿2.1 万亿(+40%)
官方定价$2 / $6未公开
上下文窗口500K未公开
官方 model card有无
API model IDgrok-4.6未公开
独立第三方评测有(AA 指数 61)未见

结论(2026-09-25 修订):分场景,不再一刀切。

  • 自建 API 调用:继续用 4.6。定价、上下文、限流三项仍缺位,官方自述存在已知短板,等文档更新再评估。
  • 走订阅制编程工具:4.7 已经在 GitHub Copilot 灰度、OpenCode v1.18.32 也已支持,可以直接在同一任务上跟 4.6 跑个 A/B——切换成本只有「改一个模型选项」,值得试。

相关阅读

来源

本卡片由 AI 之家 编辑部根据公开资料整理,非厂商付费内容。Grok 4.7 的官方 model card、基准、上下文窗口与定价截至 2026-09-16 尚未公开,参数与能力口径来自 xAI 创始人公开陈述;一切规格以 xAI 官方文档为准,欢迎在 反馈邮箱 反馈更新。

相关对比

Cursor vs Aider:GUI IDE 还是 CLI?2026 对比

Cursor vs Aider 2026 选型对比:GUI IDE vs Git 原生 CLI,从 Composer vs Architect 双模型、Tab 补全、多模型 BYOK、价格计费、开源与否和适合人群判断,帮开发者选对。Cursor 是闭源 VS Code fork 月费 $20,Aider 是开源 Apache-2.0 CLI 自带 API key。

Augment Code vs Cursor:企业 AI 编程怎么选?Context Engine vs AI IDE 对比

Augment Code vs Cursor 2026 选型对比:Context Engine 全仓索引的企业 AI 平台 vs SpaceX 收购的 AI IDE 天花板,从形态、Context 覆盖、长任务、价格、合规、中文支持和适合人群 8 个维度判断,帮你选对企业 AI 编程工具。

Cursor vs Claude Code:什么时候用哪个?(2026 实测选型)

Cursor 和 Claude Code 到底怎么选?一句话结论 + 决策树 + 价格实测 + 国内可用性对比。GUI 派选 Cursor,终端长任务派选 Claude Code,最优解其实是共存。

GitHub Copilot vs CodeBuddy:国内团队怎么选?2026 对比

GitHub Copilot 与腾讯 CodeBuddy 2026 选型对比:一个胜在生态覆盖与编辑器支持最广,一个胜在中文语境与国内直连。从产品形态、上手成本、长任务、价格与国内可用性 6 个维度给出明确取舍建议。

GitHub Copilot vs Cody:日常补全还是大型代码库理解?2026 对比

GitHub Copilot 与 Sourcegraph Cody 2026 选型对比:Copilot 胜在补全覆盖与生态最广,Cody 胜在大型代码库的代码搜索与跨仓库上下文检索。从产品形态、上手成本、长任务、价格与国内可用性给出明确取舍。

Cursor vs GitHub Copilot:AI IDE 还是插件?2026 对比

Cursor vs GitHub Copilot 2026 选型对比:AI 原生 IDE vs IDE 插件,从 Composer vs Agent Mode、Tab 补全、多模型、AI Credits 计费、企业版和适合人群判断,帮开发者选对。Cursor 是 VS Code fork 重写交互层,Copilot 是 VS Code 插件继承原生体验。两家都已切 usage 制。