grok-4.5 真的比 gpt-5.6 sol 好用吧

发布于

burnsby:

gpt-5.6 首先慢,其次贵。在使用体验上,智能程度并没有明显强过 grok-4.5。而且我超级喜欢它主动做更多事情的能力,不过在审美方面却没有太多进步。

---

原文链接:[点击查看](https://www.v2ex.com/t/1226656)

评论(11)

不知道是不是我的错觉,Grok 4.5 我用着体感贼舒服,主打一个不废话,直接就是干。

· 0 个赞

Grok 4.5 的偏科太严重了,写点简单的常规逻辑还行,一到专业领域需要复杂决策就拉胯了(感觉通用逻辑和推理能力甚至连 GLM 都不如)。不过拿它当个纯粹的代码执行模型倒还凑合。

· 0 个赞

回复

GLM 效果确实不错,但就是太慢了,生成的时候经常像挤牙膏一样一个字一个字蹦,还动不动就断连,好几次我都以为它还在跑呢,结果早就挂了。

· 0 个赞

之前 SpaceAI 收购 Cursor 搞出来的 Composer 2.5,其实就是特调版的 Kimi 2.5。我盲猜 Grok 4.5 搞不好也是套壳强化版的 Kimi 2.5。

· 0 个赞

回复

不是都说这模型是从零开始训练的嘛,而且 Grok 的上下文有 500k,Kimi 好像才 200K 吧?

· 0 个赞

Grok 4.5 最大的优势就是快,拿来当个执行模型写写脚本肯定没问题,但稍微复杂点的逻辑就不太行了。

· 0 个赞

好奇问一下,大家平时用 Grok 都是配的什么工具?直接在 Cursor 里面调吗?

· 0 个赞

回复

可以用 Grok 自家的 Grok Build 啊,我发现好多人居然都不知道有这个工具。

· 0 个赞

现在的玩法可以是拿 fable5 或者 gpt-5.6 去做高层决策,然后具体写代码的脏活累活扔给 grok4.5 干。这套组合拳打下来体验相当不错,而且还能省一笔 token 费。

· 0 个赞

Grok 4.5 这响应速度确实顶,而且帮我 Code Review 的时候还挺敏锐,能揪出以前没注意到的坑。至于具体写代码的实际表现如何,我还没来得及深入测一下。

· 0 个赞

SWE-bench 的研究表明,给大模型搭配合适的 ACI 接口,效果远比单纯换个更强的模型要好。说白了,现阶段与其纠结用哪个模型,不如多花点心思打磨好用的工具集,这个收益反而更大。

· 0 个赞