Grok 4.7 发布:换了更大的基座,价格和速度跟 4.6 一样
xAI(官网现署名 SpaceXAI)2026-09-21 发布。上下文 500K,输入文本和图片、输出文本,推理强度 low 到 xhigh,$2 / $6 每百万 token,与 Grok 4.6 同价同速;Grok 4.7 Fast 只在 Cursor 和 Grok Build 里
按 2026-09-29 的状态整理。规格与价格来自 xAI 开发者文档的模型页、定价页和发布说明,评测数字来自官方发布公告,都是厂商自测。页末附全部来源。
hihi!洛洛来了!
Grok 4.7 在洛洛 AI 的模型选择里标着「xAI 最新款」,每问 2 核,属于不心疼的那一档。洛洛补这篇,是想看看它跟上个月的 4.6 比到底变了什么。
洛洛碎碎念
公告标题下面写着「快一倍,价格是同级模型的一半」,下一段又说「和 Grok 4.6 同价同速」。
洛洛读了两遍才明白:快和便宜是跟别家比的,跟自家上一代比是一模一样。
一句话总结
xAI(官网和文档现在署名 SpaceXAI)在 2026-09-21 发布 Grok 4.7,API 模型名 grok-4.7。换了更大的基座、跑了更长的强化学习,上下文 500K,输入文本和图片、输出文本,推理强度 low / medium / high / xhigh(默认 high)。价格 $2 输入 / $0.50 缓存 / $6 输出每百万 token,和 8 月的 Grok 4.6 完全一样。官方自测 DeepSWE v1.1 从 4.6 的 65.2% 升到 71.0%,Terminal-Bench 4.0 从 20.3% 升到 37.6%。更快的 Grok 4.7 Fast 只在 Cursor 和 Grok Build 里提供。
时间线
| 日期 | 事件 |
|---|---|
| 2026-08-12 | Grok 4.6 上线 xAI API,500K 上下文,$2 / $0.50 / $6 |
| 2026-09-21 | Grok 4.7 发布,grok-4.7 上线 API,同日在 Cursor 和 Grok Build 可用;Grok 4.7 Fast 同步提供,只在这两处 |
| 截至 2026-09-29 | 本站洛洛 AI 可选 Grok 4.7(经 ZenMux,每问 2 核) |
关键数字
来自 xAI 模型页和发布说明。
| 项目 | Grok 4.7 |
|---|---|
| 模型 ID | grok-4.7 |
| 上下文窗口 | 500,000 tokens |
| 最大输出 | 发布说明写「没有文本输出上限」 |
| 输入 / 输出模态 | 文本、图片 / 文本 |
| 推理强度 | low、medium、high、xhigh,默认 high |
| Batch API | 不支持 |
| 速率限制 | 每秒 150 次请求,每分钟 5000 万 token |
架构
官方只说换了一个「新的、更大的基座模型」,强化学习跑得更久、题目更难,偏向要花好几个小时的任务;还专门训练它适配自家 Grok Bot 的运行框架。参数量和结构都没公开。网上流传的「2.1 万亿参数」「用 SpaceX / Starlink 数据训练」,洛洛在官方公告和文档里都没找到,官方未证实,当传闻看。
评测
以下是 xAI 公告里的对比表,都是 xAI 自测,括号里是推理强度。别家那几列是 xAI 表里的数字,不等于别家的官方成绩:比如 Fable 5.1 的 Terminal-Bench 4.0,这张表写 57.9%,Anthropic 自己公布的是 55.8%。
| 基准 | Grok 4.7(xhigh) | Grok 4.6(high) | GPT-5.6 Sol(max) | Fable 5.1(max) |
|---|---|---|---|---|
| CursorBench 4.0 | 46.3% | 40.4% | 41.7% | 51.8% |
| DeepSWE v1.1 | 71.0%(high 档) | 65.2% | 72.7% | 70.0% |
| EEBench(电气工程) | 64.0% | 53.0% | 39.4% | 56.4% |
| AA Briefcase v1.1(多小时办公) | 1,657 | 1,546 | 1,487 | 1,678 |
| Terminal-Bench 4.0 | 37.6% | 20.3% | 37.3% | 57.9% |
| Harvey Legal Agent Benchmark | 19.6% | 15.8% | 2.5% | 6.7% |
| HealthBench Professional | 56.7% | 48.5% | 60.5% | 62.1% |
怎么读:
- 跟 4.6 比每一项都涨了,Terminal-Bench 4.0 几乎翻倍
- 跟表里最贵的 Fable 5.1 比,CursorBench 和 Terminal-Bench 4.0 仍落后一截,赢面在电气工程和法律这类专业任务上。官方的说法是它在 CursorBench 4.0 上「性价比处在前沿」,不是绝对分数第一
- 安全方面,公告称它在 LatchBio 生物安全基准拿到 62.4%,在自家 HackerBench v0.3 上只放过 3.3% 的高风险双用途请求
API 与价格
官方价格(美元 / 每百万 token):
| 计费项 | 提示不到 200K | 提示达到 200K |
|---|---|---|
| 输入 | $2.00 | $4.00 |
| 缓存输入 | $0.50 | $1.00 |
| 输出 | $6.00 | $12.00 |
提示达到 200K 时,整次请求的所有 token 都按高价算。走美国区域端点(us.api.x.ai)再加 10%。
Grok 4.7 Fast 是同一个模型跑在更快的机器上,公告说输出速度约两倍。价格是标准价的 2 倍(长上下文 1.5 倍),只在 Cursor 和 Grok Build 里用,按那边的套餐计费,公开 API 调不到,Grok Build 免费档也不含。
价格随时可能调整,以官方定价页为准。
对你意味着什么
- 用 Cursor 的:发布当天就能选,Fast 版也在 Cursor 里,按你的 Cursor 套餐计费
- 调 API 的:从
grok-4.6换成grok-4.7只改模型名,价格、上下文、推理档位都一样。提示尽量压在 200K 以内,否则整单翻倍 - 本站用户:洛洛 AI 里 Grok 4.7 每问 2 核,和 Claude Sonnet 5、GPT-6 Sol 同档。本站给它设的推理强度是 low、单次回答最多 2048 token,而官方 API 默认是 high,所以站内回答和直接调官方接口不一样,别拿来直接比。苹果核目前试运行,计划 2026-10-13 起正式扣,见苹果核规则
局限
- 分数全是 xAI 自测,DeepSWE 那格用的还是 high 档;HealthBench Professional 落后表里的 GPT-5.6 Sol 和 Fable 5.1
- 参数量、架构、知识截止官方都没写
- 不支持 Batch API,Fast 版公开 API 用不了
洛洛写完这篇最大的感受是:价格不动、速度不动,只把分数往上推一截,这种小版本对用户最省心,换个模型名就完事。
数字都会过期,看到这篇的时候记得回官方页面对一眼。更多新模型速览在模型时讯。
参考来源
官方:
- xAI 发布公告《Introducing Grok 4.7》:https://x.ai/news/grok-4-7(2026-09-21)
- Grok 4.7 模型页:https://docs.x.ai/developers/models/grok-4.7(查阅于 2026-09-29)
- xAI 发布说明(2026-09-21 Grok 4.7 条目、2026-08-12 Grok 4.6 条目):https://docs.x.ai/developers/release-notes(查阅于 2026-09-29)
- xAI 定价页(长上下文价、美国区域端点、Grok 4.7 Fast 价格):https://docs.x.ai/developers/pricing(查阅于 2026-09-29)
本站每问核数和推理强度来自仓库里的 config/ai.yaml,截至 2026-09-29。
Claude Opus 5.5 发布:降到 $4 / $20,思考关不掉,洛洛 AI 现在的默认模型
Anthropic 2026-09-22 发布,Claude 5.5 家族第一款。1M 上下文、128K 输出,输入 $4 / 输出 $20 每百万 token(Opus 5 是 $5 / $25),缓存读取 $0.20;思考常开、默认 effort 改为 medium,强制调工具会报错。本站洛洛 AI 经 ZenMux 默认用的就是它
阶跃 Step 5 Preview 上线:1M 上下文、能看图看视频,每百万 token 输入 7 元、输出 20 元
阶跃星辰 2026-09-20 发布的新一代旗舰基模预览版。1M 上下文、64K 最大输出,输入文本、图片、视频,推理强度 low / medium / high;输入 7 元、缓存命中 0.35 元、输出 20 元每百万 token。官方没公布评测和参数量,权重未开放,本站洛洛 AI 暂时选不到