grok-4.5 对比测评

实测对比 grok-4.5 与 gpt-5.6 sol / opus-4.8:价格结构里的缓存陷阱、代码审查与前端审美、以及「干活用 grok、审查用 sol」的分工打法。

实测向模型对比。价格为官方标价(每百万 token),能力结论来自同一批任务的并行对照,不代表所有场景。

一句话结论

grok-4.5 可以平替 opus-4.8,更适合当 gpt-5.6 sol 的副手:让它干重活,让 sol 做终审。 前端、文案、速度都值得单独用;价格要看倍率,别只盯输出单价。


背景

grok-4.5 是马斯克收购 Cursor 之后、基于大量用户代码数据训练出来的模型,发布于 7 月 8 日。

实测体感:比肩 opus-4.8。价格、速度、审美、文案整体都不错,日常可以放心理会。


价格:输出很香,缓存才是大头

官方标价对照($/1M tokens)

模型输入缓存输入输出缓存写入
grok-4.5$2$0.5$6—
gpt-5.6 sol$5$0.5$30$6.25
gpt-5.6 terra$2.5$0.25$15$3.125

看起来很便宜的地方

  • 单看 输出价:grok-4.5 只有 gpt-5.6 sol 的 1/5($6 vs $30)。
  • 同等倍率下,grok-4.5 通常比 gpt-5.6 更便宜。

真正的陷阱

对比 gpt-5.6 时:

维度grok-4.5 vs gpt-5.6
缓存输入差不多(都是 $0.5 量级)
普通输入grok 约为 sol 的 1/2.5($2 vs $5)
输出grok 明显更低

日常写代码 / Agent 场景里,缓存命中往往超过 90%,大头费用其实花在 缓存输入 + 输入 上,而不是输出。

所以:

输出价压得很低,看起来像花招;真正决定账单的是缓存命中后的输入结构,以及平台倍率。

落地怎么算账

  • 官方原价、同等倍率:grok-4.5 往往更划算。
  • 实际采购:如果 gpt 走白菜价、倍率更低,用 grok-4.5 反而可能更贵。
  • 选型别只比「输出 $6 vs $30」,要按你账号的真实倍率和缓存命中率算一笔账。

能力:和 gpt-5.6 sol 的几组实测

以下都是 同一任务、两边并行 的对照,不是榜单分数。

1. 代码审查 + 修复

让 gpt-5.6 sol 和 grok-4.5 同时审查同一份代码 bug,多轮「审查 → 修复」下来:

  • 审查结论基本一致
  • gpt-5.6 sol 只多抓到 2 个无伤大雅 的问题

解读: 主路径 bug 两边都能搞定;sol 终审更细一点,但差距不大。

2. 前端审美

让 grok-4.5 写前端:一句话就能出好看页面,前端审美整体 强于 gpt。

适合:落地页、运营页、后台壳子、快速 UI 原型。

3. 后端模拟测试

同一套 Docker 环境下的后端模拟测试,两边结果 一致。

说明:不只是「会聊天」,工程链路(环境、命令、断言)也能跟得上。

4. 写代码速度

模型体感
grok-4.5写代码 非常快
gpt-5.6 sol容易 墨迹、偏慢

适合把 grok 放在「快速出片 / 批量改代码」位置。

5. 文案

grok-4.5 文案能力也不错,比 gpt 的 AI 味淡不少。

适合:产品文案、说明文档、对外公告草稿(仍建议人工过一遍事实与口径)。


推荐分工

日常写代码 / 前端 / 文案  →  grok-4.5(快、好看、好写)
关键审查 / 终审 / 抠细节  →  gpt-5.6 sol(更稳、更细)
opus-4.8 档位的重活      →  可先试 grok-4.5 平替

一句话:

grok-4.5 干活,gpt-5.6 sol 审查。
前端和文案还可以直接用 grok 顶替 gpt;价格和速度都香,但要结合你的实际倍率。


接入哪里更好

同一模型,测了 Claude Code、OpenCode、Cursor 三家:

  • 好用程度:Cursor 更顺
  • 缓存命中:Cursor 更高(账单对缓存敏感时,这一点更关键)

想把自定义模型 / BYOK 接到 Cursor,可以用:

my-cursor · 配置步骤见 my-cursor 配置 Cursor


顺带:gpt-5.6 sol 自身进度

  • 市场普遍在说 gpt-5.6 sol 超过 fable-5;本文未做该对照,从社区反馈看大概率成立。
  • 对比 gpt-5.5:gpt-5.6 sol 提升很明显。
    • 现在:sol 自己写代码 → 自审几轮 → 再交审查,经常能直接过。
    • 以前:gpt-5.5 交审查,几乎每次都会被揪出几个问题。

速查卡

问题答案
能不能当主力干活?能,尤其前端、文案、快速编码
能不能平替 opus-4.8?实测体感可以
要不要完全换掉 gpt-5.6 sol?不建议;更适合 副手 + 终审 组合
输出很便宜是不是真省?缓存命中高时,账单仍看输入/缓存和倍率
什么时候 grok 更贵?gpt 走低倍率白菜价时
接 Claude Code / OpenCode / Cursor 哪个好?实测还是 Cursor 更好用、缓存命中更高
Cursor 怎么接自定义模型?my-cursor,图文见 my-cursor 配置 Cursor

适用边界

  • 本文是 实战对照笔记,不是官方榜单或全量评测。
  • 价格以官方目录价为基准;第三方中转、套餐、分组倍率会改结论。
  • 模型会迭代,能力与定价以你当前可用的线上版本为准。