前两天大伙还在看马斯克预热,9 月 21 日,xAI 的 Grok 4.7 终于正式推出来了。这次更新主攻编程、耗时长的任务和知识工作,官方也把 Grok Build、Cursor 和 API 的入口全放开了。发布公告
对日常天天用 GPT-6 的人来说,最直接的疑问无非是:Grok 4.7 到底涨了多少本事?我真有必要再开一个会员去尝鲜吗?
直接说结论:Grok 4.7 这次不管在能力还是定价上,都够格拿来和 GPT-6 认真较较劲;但 GPT-6 Astra 在复杂活儿上的底子依然很硬。两家发力点不同,手头已经用顺的工具,真没必要脑子一热就丢掉。
另外,咱们 PayForChat 现在也支持充 Grok 会员了,流程跟平时充 GPT 一样简单。这篇文章咱不吹不黑,先把两款模型摆开来聊透,文末再跟你说想试的话怎么搞。
这次 Grok 4.7,升级主要落在“把事情做完”
前一阵我们写过马斯克关于 Grok 4.7 和 4.8 的剧透。现在 4.7 正式发了,咱们就能抛开 PPT,按真凭实据聊了。
按 xAI 官方的说法,4.7 换了比 4.6 更大的底模,专门加了一堆针对“困难、耗时长任务”的强化学习训练,重点抠两个点:模型自己的检查纠错,以及长上下文把控。同时它还专门针对 Grok Bot 的协同模式做了优化,把能力铺到了日常知识办公里。模型改进说明
说人话,这些升级解决的都是最实际的痛点:比如改个功能牵扯到好几个文件,改完它能不能自己跑一遍检查下?或者扔给它一大堆材料,最后能不能吐出一份结构清晰、能直接接着改的文档?用这类工具,最终给的结果能不能直接用,远比开头第一段吐字快不快、好不好听重要得多。
第三方机构的测试也证实了这一点。Artificial Analysis 在 9 月 21 日的最新报告里测出:Grok 4.7 配上 Grok Build,在 Coding Agent Index(编程代理指数)上从上代的 47 分蹦到了 56 分;在原生编程工具排行榜里排第 4,不过排在前面的依然有 GPT-6 Astra。而在知识工作基准测试 AA-Briefcase 上,它拿到了 1657 Elo,比之前的 Grok 4.6 High 足足涨了 111 分。独立评测
所以实事求是地看:Grok 4.7 确实在拼命往前追,完全有资格进大家的备选名单;但如果有人现在就吹它“全面秒杀 GPT-6”,那纯属不负责任。
和 GPT-6 放在一起,差别在哪里?
这里说的 GPT-6,具体指的是目前主力版本 GPT-6 Astra。
咱们先看 xAI 官方放出来的三张核心对比图(直接导自官方矢量图表,模型档位和原始数值都在):
专业知识工作:GDPval

图源:xAI Grok 4.7 发布页。该项测试中,Grok 4.7 xhigh 为 1695 Elo,GPT-6 Astra max 为 1542 Elo。
多小时办公任务:AA-Briefcase

图源:xAI Grok 4.7 发布页。该项办公任务测试中,Grok 4.7 xhigh 为 1657 Elo,GPT-6 Astra max 为 1569 Elo。
电气工程:EEBench

图源:xAI Grok 4.7 发布页。这项测试中 GPT-6 Astra max 更高,为 69.3%;Grok 4.7 xhigh 为 64.0%。
这几张图把两边的长短板标得很清楚:上面两项知识工作测试,Grok 4.7 确实占上风;但换到硬核的电气工程测试 EEBench,Astra 又把场子找了回来。再加上前面第三方实测的编程代理排名 Astra 依旧压一头,你很难单凭某一张图断言谁就碾压谁。
再来看平时选模型时最敏感的账面参数和调用价格:
| 比较项 | Grok 4.7 | GPT-6 Astra |
|---|
| 官方强调的方向 | 编程、智能体任务、知识工作 | 复杂推理、编程、计算机操作、研究和文档交付 |
| 配套工作工具 | Grok Build;Grok 生态还有 Grok Bot | Codex、ChatGPT Work |
| API 上下文窗口 | 50 万 token | 105 万 token |
| 标准 API 普通输入价 | 每百万 token $2 起 | 每百万 token $10 |
| 标准 API 输出价 | 每百万 token $6 起 | 每百万 token $50 |
注:模型规格与单价分别来自 Grok 4.7 文档 和 GPT-6 Astra 文档。价格为标准的短上下文普通输入输出口径,没算缓存命中、工具计费及其它特殊档位;Grok 超过 200K、Astra 超过 272K 的长上下文有额外的计价档位。
单看 API 标价,Grok 确实便宜很多。但 Astra 也有自己的绝活:不仅上下文窗口给到了超大的 105 万 token(Grok 为 50 万),而且在跨应用、调工具、摸索复杂项目时的连贯性非常稳。不过也要提醒一句:上下文大只代表能塞进去更多字,不代表一股脑把所有文件扔进去就一定能答对。
另外写代码的朋友注意:别只盯着聊天框。Grok Build 和 Codex 这种外挂工程环境,决定了模型怎么读你的工程目录、怎么执行终端命令、怎么自动跑测试修代码。做真实项目时,得把整套工作流加进去一起比,单贴一段算法让它们猜,说明不了多少问题。想深入了解 Astra 怎么操作界面的,可以看我们之前写的GPT-6 计算机操作指南。
单价低,做同一件事就一定更便宜吗?

图源:xAI Grok 4.7 发布页,CursorBench 4.0 的 Cost 视图。横轴是每项任务的平均成本,纵轴是测试成绩。这张图包含 GPT-5.6 Sol,没有 GPT-6 Astra,不能用它直接判断 Grok 4.7 与 GPT-6 的编程胜负;图中金额也不是会员价格。
先给做开发的同学粗算一笔账。
假定一个常规任务,总共消耗 10 万普通未缓存的输入 token、2 万输出 token,都在短上下文里,不计缓存写入和第三方工具调用:
- 用 Grok 4.7:费用大概是 $0.32
- 用 GPT-6 Astra:费用大概是 $2.00
看着 Grok 便宜一大截对吧?但账真不能这么死板算。
Artificial Analysis 在实测中就发现一个细节:在做同等难度的推理测试时,Grok 4.7 xhigh 吐出来的输出 token 数量明显比 Astra max 更多。换句话说,Grok 单价虽低,但可能需要更长的推理步骤;如果遇到卡壳重试、反复修改代码,真实花销根本不可能单纯按标价比例缩放。评测中的用量观察
更关键的是:如果你是用网页端或 App 的普通订阅用户,上面这些 API 单价跟你半毛钱关系都没有。
会员买的是包月额度和服务体验。别一看到 API 便宜,就脑补会员订阅也一定赚了,主要还是看它一个月给多少次提问额度、高峰期卡不卡、用起来省不省心。
已经有 ChatGPT,还值得试 Grok 吗?
归结到最核心的纠结:手头早就有 ChatGPT 会员了,到底有没有必要再搞个 Grok?
要是你的主力活儿在 Codex 或者 ChatGPT Work 里已经跑得很顺溜,踏踏实实继续用 GPT-6 就行。 你的 prompt 习惯、上下文工程、项目配置全是沉淀下来的成本,盲目换工具光是重新磨合就挺折腾。Grok 4.7 出来,最大的好处是市场上多了个能打的备选,不用着急。
但如果你之前嫌 Grok 4.6 差点意思,或者手头经常要做大批量写代码、扒资料、写方案,想找个第二备份,那 4.7 绝对值得你亲自上手测测。 它这次在智能体编程和知识提炼上的进步是实打实的,不是单纯刷版本号的噱头。
想对比其实也很简单,别光看别人跑分,拿你手头最熟的一件真实任务去喂它们:
- 修 Bug:挑个你刚好知道怎么改的典型报错,看两边谁能一把修好,谁修完了还顺带改坏其他文件。
- 理资料:丢给它们几万字的材料,看谁抽出来的数据精准,谁在满嘴跑火车。
- 写小脚本:做个自动化小工具,看谁给出的代码开箱即用,后续改起来也不费劲。
看哪边花的时间短、少让你翻白眼重问几次、给出的活儿能直接交差。自己上手跑一轮,比看网上神仙打架有用得多。
想了解 GPT-6 发布细节和背景的朋友,可以回看我们的GPT-6 Astra 发布指南。
想尝鲜 Grok,PayForChat 现在也能充值了
要是你打算搞个 Grok 尝尝鲜,咱们 PayForChat 现在也把 Grok 充值通道给开通了。
充值流程跟平常用 GPT 充值没啥两样:
- 打开 Grok 充值页,选好你要开的套餐(目前支持 Grok Super 和 Super Heavy)和订阅时长。
- 填写你 Grok 账号的 UUID(也就是页面教程里提到的
userId)。全程不需要填密码,安全省心。
- 用微信或支付宝扫码付款,搞定后在订单页看开通状态就行。
注:页面价格、库存和到账时间以付款时的实时提示为准。如果你当前的 Grok 账号本身还有未过期的 Super 或 Super Heavy 会员,建议等到期后再来续费,避免权益冲突。
到底继续单守 ChatGPT,还是双持一个 Grok,大家根据自己的钱包和活儿来定就行。另外说明一下:咱们办理的是网页端会员订阅,能用什么模型和每天多少条额度全按官方规则来;如果要是调用底层 API,那是开发者后台单独绑卡扣费的事,两者可别搞混了。
PayForChat 是独立第三方充值服务,与 OpenAI、xAI 无从属关系。
FAQ
Q: Grok 4.7 现在是画饼还是已经能用了?
A: 已经正式上线了。xAI 官方是在 2026 年 9 月 21 日发布的,Grok Build、Cursor 和 API 接口都已经放开。你的账号能切到什么模型,以当前官网页面展示为准。
Q: Grok 4.7 到底有没有比 GPT-6 强?
A: 没有谁能一口咬定谁碾压谁。Grok 4.7 这次在知识工作和日常写代码上确实跃进了一大步,而且 API 单价极其便宜;但如果要比复杂场景下的编程 Agent 能力,第三方实测榜单上依然是 GPT-6 Astra 更胜一筹。
Q: 手里有 ChatGPT 会员了,还有必要开 Grok 吗?
A: 看需求,不用盲目跟风。如果现有工作流完全够用,老老实实接着用就行;如果是高频敲代码、查资料,或者就是想换个脑子对比下各家效果,弄个号拿真实活儿试试最实在。
Q: 在 PayForChat 充 Grok 和平时充 GPT 一样吗?
A: 流程基本一致。选好套餐后,只用填你的 Grok 账号 UUID(页面有教程教你怎么看),不需要给账号密码;微信或支付宝扫码搞定,付完到订单页查进度就行。
Q: Grok 充值的价格多少?多久到账?
A: 请以 Grok 充值页 结算时的实时提示为准。因为汇率和官方策略会变动,文章里不写死固定金额;另外注意这里充的是官网会员订阅,不是 API 开发者调用余额。
参考来源
更新记录
- 2026-09-22:根据 9 月 21 日正式发布公告整理;比较对象限定为 GPT-6 Astra,区分厂商说明、独立评测与本站建议,加入 Grok 充值入口。
- 2026-09-22:补充 xAI 官方 GDPval、AA-Briefcase、EEBench 和 CursorBench 成本图,逐图注明来源、模型与测试口径。