grok-4.5 对比测评
实测对比 grok-4.5 与 gpt-5.6 sol / opus-4.8:价格结构里的缓存陷阱、代码审查与前端审美、以及「干活用 grok、审查用 sol」的分工打法。
实测向模型对比。价格为官方标价(每百万 token),能力结论来自同一批任务的并行对照,不代表所有场景。
一句话结论
grok-4.5 可以平替 opus-4.8,更适合当 gpt-5.6 sol 的副手:让它干重活,让 sol 做终审。 前端、文案、速度都值得单独用;价格要看倍率,别只盯输出单价。
背景
grok-4.5 是马斯克收购 Cursor 之后、基于大量用户代码数据训练出来的模型,发布于 7 月 8 日。
实测体感:比肩 opus-4.8。价格、速度、审美、文案整体都不错,日常可以放心理会。
价格:输出很香,缓存才是大头
官方标价对照($/1M tokens)
| 模型 | 输入 | 缓存输入 | 输出 | 缓存写入 |
|---|---|---|---|---|
| grok-4.5 | $2 | $0.5 | $6 | — |
| gpt-5.6 sol | $5 | $0.5 | $30 | $6.25 |
| gpt-5.6 terra | $2.5 | $0.25 | $15 | $3.125 |
看起来很便宜的地方
- 单看 输出价:grok-4.5 只有 gpt-5.6 sol 的 1/5($6 vs $30)。
- 同等倍率下,grok-4.5 通常比 gpt-5.6 更便宜。
真正的陷阱
对比 gpt-5.6 时:
| 维度 | grok-4.5 vs gpt-5.6 |
|---|---|
| 缓存输入 | 差不多(都是 $0.5 量级) |
| 普通输入 | grok 约为 sol 的 1/2.5($2 vs $5) |
| 输出 | grok 明显更低 |
日常写代码 / Agent 场景里,缓存命中往往超过 90%,大头费用其实花在 缓存输入 + 输入 上,而不是输出。
所以:
输出价压得很低,看起来像花招;真正决定账单的是缓存命中后的输入结构,以及平台倍率。
落地怎么算账
- 官方原价、同等倍率:grok-4.5 往往更划算。
- 实际采购:如果 gpt 走白菜价、倍率更低,用 grok-4.5 反而可能更贵。
- 选型别只比「输出 $6 vs $30」,要按你账号的真实倍率和缓存命中率算一笔账。
能力:和 gpt-5.6 sol 的几组实测
以下都是 同一任务、两边并行 的对照,不是榜单分数。
1. 代码审查 + 修复
让 gpt-5.6 sol 和 grok-4.5 同时审查同一份代码 bug,多轮「审查 → 修复」下来:
- 审查结论基本一致
- gpt-5.6 sol 只多抓到 2 个无伤大雅 的问题
解读: 主路径 bug 两边都能搞定;sol 终审更细一点,但差距不大。
2. 前端审美
让 grok-4.5 写前端:一句话就能出好看页面,前端审美整体 强于 gpt。
适合:落地页、运营页、后台壳子、快速 UI 原型。
3. 后端模拟测试
同一套 Docker 环境下的后端模拟测试,两边结果 一致。
说明:不只是「会聊天」,工程链路(环境、命令、断言)也能跟得上。
4. 写代码速度
| 模型 | 体感 |
|---|---|
| grok-4.5 | 写代码 非常快 |
| gpt-5.6 sol | 容易 墨迹、偏慢 |
适合把 grok 放在「快速出片 / 批量改代码」位置。
5. 文案
grok-4.5 文案能力也不错,比 gpt 的 AI 味淡不少。
适合:产品文案、说明文档、对外公告草稿(仍建议人工过一遍事实与口径)。
推荐分工
日常写代码 / 前端 / 文案 → grok-4.5(快、好看、好写)
关键审查 / 终审 / 抠细节 → gpt-5.6 sol(更稳、更细)
opus-4.8 档位的重活 → 可先试 grok-4.5 平替
一句话:
grok-4.5 干活,gpt-5.6 sol 审查。
前端和文案还可以直接用 grok 顶替 gpt;价格和速度都香,但要结合你的实际倍率。
接入哪里更好
同一模型,测了 Claude Code、OpenCode、Cursor 三家:
- 好用程度:Cursor 更顺
- 缓存命中:Cursor 更高(账单对缓存敏感时,这一点更关键)
想把自定义模型 / BYOK 接到 Cursor,可以用:
my-cursor · 配置步骤见 my-cursor 配置 Cursor
顺带:gpt-5.6 sol 自身进度
- 市场普遍在说 gpt-5.6 sol 超过 fable-5;本文未做该对照,从社区反馈看大概率成立。
- 对比 gpt-5.5:gpt-5.6 sol 提升很明显。
- 现在:sol 自己写代码 → 自审几轮 → 再交审查,经常能直接过。
- 以前:gpt-5.5 交审查,几乎每次都会被揪出几个问题。
速查卡
| 问题 | 答案 |
|---|---|
| 能不能当主力干活? | 能,尤其前端、文案、快速编码 |
| 能不能平替 opus-4.8? | 实测体感可以 |
| 要不要完全换掉 gpt-5.6 sol? | 不建议;更适合 副手 + 终审 组合 |
| 输出很便宜是不是真省? | 缓存命中高时,账单仍看输入/缓存和倍率 |
| 什么时候 grok 更贵? | gpt 走低倍率白菜价时 |
| 接 Claude Code / OpenCode / Cursor 哪个好? | 实测还是 Cursor 更好用、缓存命中更高 |
| Cursor 怎么接自定义模型? | my-cursor,图文见 my-cursor 配置 Cursor |
适用边界
- 本文是 实战对照笔记,不是官方榜单或全量评测。
- 价格以官方目录价为基准;第三方中转、套餐、分组倍率会改结论。
- 模型会迭代,能力与定价以你当前可用的线上版本为准。