Grok 4.7 logo

Grok 4.7

打开

SpaceXAI 的 Grok 4.7 旗舰,面向编码与智能体:50 万 token 上下文,$1.60/$4.80 每百万 token,Artificial Analysis 智能指数 46.4。

分享:
查看替代方案

Grok 4.7 是 SpaceXAI 接替 Grok 4.6 的旗舰模型,定位是长时间运行的软件工程、知识工作与智能体任务。该模型于 2026-09-21 出现在 OpenRouter 的模型库中,规范 slug 为 grok-4.7-20260916;GitHub 官方文档也把 Grok 4.7 与 Grok 4.5、4.6 一同列为 GitHub Copilot 中的 GA(正式可用) 模型。Devin Desktop 与 Devin CLI 也已上线。列表上最醒目的数字是 Artificial Analysis 智能指数 46.4,高于 Grok 4.6 的 44.3

模型规格

项目 Grok 4.7
上下文窗口 500,000 token
最大输出 450,000 token
输入 文本、图像、文件
输出 文本
推理强度 low、medium、high(默认)、xhigh;推理为强制开启
工具调用 / 结构化输出 通过 OpenRouter 端点支持
许可 闭源权重

SpaceXAI 没有公布 Grok 4.7 的参数量。发布前流传的「2.1T」来自 Elon Musk 的 X 帖子而非模型卡,Grok 4.5 与 4.6 背后的 1.5T 也是同一来源。因此你看到的任何关于该模型参数量的说法都应视为未确认。

定价

下表是 2026-09-22 核对的 OpenRouter 列表价,单位为每百万 token。

提示长度 输入 缓存输入 输出
< 20 万 token $1.60 $0.40 $4.80
≥ 20 万 token $3.20 $0.80 $9.60

联网搜索为每次请求 $0.005。相比 Grok 4.6 的 $2.00 输入 / $6.00 输出,标称价格低了约 20%,而长提示的加价是翻倍而不是三倍。

需要注意的 token 成本

单价便宜并不等于任务便宜。社区引用的 Artificial Analysis 输出 token 统计显示,Grok 4.6 High 每个任务约 36,000 token,而 Grok 4.7 High 约 66,000 token,发布当天 Reddit 与 X 上的讨论几乎都围绕这个取舍展开,也有开发者表示日常任务会退回 Grok 4.6。如果你真正优化的是「每个完成任务的成本」,请先用自己的真实任务轨迹验证,再决定是否让整个团队切换。

可用渠道

  • GitHub Copilot:GitHub 官方支持模型文档中列为 GA。
  • Devin:Devin Desktop 与 Devin CLI 已可用。
  • Vercel AI Gateway:SpaceXAI 官方账号宣布 Grok 4.7 在 AI Gateway 上有 40% 折扣,活动持续到 2026-09-27
  • OpenRouter 与 Grok API:已上架并可直接调用。
  • 消费端应用:发布当天 Grok 应用仍在灰度推送,有用户反馈尚未收到。

局限与风险

  • 闭源权重。 与 Grok 系列一致,它是 API 与订阅模型,不是可下载权重。
  • 参数量未获证实。 发布前的 2.1T 传闻未获 SpaceXAI 确认。
  • 独立评分不完整。 发布时 OpenRouter 上只有智能指数,编码与智能体指数尚缺,而 Grok 4.6 两项都已有。
  • 首周口碑分化。 最集中的批评指向 token 消耗,而不是能力本身。
  • 长提示惩罚。 提示超过 20 万 token 后,所有费率翻倍。

常见问题

Grok 4.7 比 Grok 4.6 更强吗?

按 Artificial Analysis 智能指数,列表显示 46.4 对 44.3,在可测智能上确实更强。成本则取决于你的任务实际产生多少 token,而「4.7 消耗远超 4.6」正是传播最广的抱怨。

是开源权重吗?

不是,Grok 4.7 为闭源。如果想在这个价位带找开源权重,可以对比 DeepSeek V4 Pro 0813

现在可以在哪里使用?

GitHub Copilot、Devin Desktop 与 Devin CLI、OpenRouter、xAI API,以及 Vercel AI Gateway。

支持调节推理强度吗?

支持。low、medium、high(默认)与 xhigh 均可用,且推理是强制开启而非可选项。

替代方案

  • Grok 4.6:上一代旗舰,对很多编码任务而言每个完成任务的成本仍然更低。
  • Claude Opus 5:可控推理强度的企业级编码与长周期智能体任务的参照点。
  • GPT-5.6 Sol:OpenAI 旗舰,也是 Grok 4.7 在价格上最常被对比的模型。

总结

Grok 4.7 是一次方向明确、价格更锐利的迭代:可测智能高于 Grok 4.6,单 token 成本更低,并且在 GitHub Copilot 与 Devin 里首日可用,这正是大多数开发者实际会接触它的地方。真正的变量是 token 效率。请先在自己的工作负载上跑一遍,再判断更便宜的价格表是否带来更便宜的任务。

相关:DevinCursor。分类页:models

评论

还没有评论。成为第一个评论的人!