claude 的 workflow 收益是否真的很大,是否是阻止转 gpt 的最大因素

发布于

rizon: 我现在 codex 都是拿来做一些快速提问的,开发还是选择使用 claude。

核心原因是 claude 的工作流的对抗式审查让我更安心。不过,我不知道这是不是仅仅是一种错觉。虽然它确实能查出许多 bug 并加以修复,但这些 bug 是否需要修复我也没仔细分辨,可能也有很多误判。

另一个原因是我比较习惯 claude code 的终端 UI,虽然 codex 的 UI 其实也还不错,但一些小习惯不足以构成真正的壁垒。

目前我主要使用 opus 4.8 的 xhigh,如果换成 codex,就得选择 5.6 sol 的极高思考模式,但我觉得 5.6 sol 极高的额度消耗实在有些过大。

因此我想看看大家在 codex 和 claude 之间的体验如何,大家是基于什么原因而选择信任其中一个。

----

此外,我还有一个小问题。之前我用 iterm2,但最近换成了 ghostty,我依旧很喜欢 ghostty 的使用体验。即使 iterm2 换上了 jetbrains 的等宽字体,我还是觉得 ghostty 更为舒适。不过 ghostty 最大的问题是中文输入法存在严重 BUG。在 TUI 下中间位置输入汉字时,常常会导致后面的字符被删除。这一点不知道大家有没有解决方案,或者有没有更好的终端选择。wrap 我不习惯,这个集成了太多功能,而且产品本身的商业化策略必然会与开发者的需求产生许多冲突。我觉得与 code cli 的功能也有重叠的问题,还是希望使用更简单一点的终端。

---

原文链接:[点击查看](https://www.v2ex.com/t/1226921)

评论(12)

楼主的工作流是怎么搞的?我好像没碰到过这种。我现在是两个模型混着用,谁的额度有富余就用谁,然后两边通过 docs 来传递信息。

· 0 个赞

回复

回复 @kuhung:其实就是开启 xhigh 加 workflow 模式,一般它干完活会自己做一轮对抗式审查。或者你主动切到 ultracode 模式下,跟 AI 说做一次对抗式审查也行。

· 0 个赞

感觉开 workflow 有点浪费 tokens,跟不开 workflow 的 GPT 比并没有明显差距。就算是没开 workflow 的 GPT,也能查出 ultracode 的 fable 没发现的问题。我觉得与其开 workflow,还不如直接让 codex 和 claude 分别独立审一遍。

· 0 个赞

回复

其实跨 AI 或者人工去做审查,主要是太消耗我们开发者的心力了。如果人去介入,就会被拉进对结果的验证和不信任之中,会让人非常疲惫。咱们人的精力和心力也是有额度的,得科学管理,不能随便乱花。

· 0 个赞

其实 codex 也能实现类似的效果,你可以让它自己不断去派发 subAgent 来进行对抗式审查。

· 0 个赞

回复

哦哦,我 codex 平时用得不多,这个还真不知道。具体应该怎么操作才能让 codex 自动去做一次对抗审查,然后顺带把 BUG 也给改了呢?

· 0 个赞

顺便再蹲大家一个经验,我从来没用过 codex 和 claude 的 goal 模式,这个模式的实际收益如何啊?大家一般都在什么场景下用?

· 0 个赞

说说我自己的体验:Opus 4.8 xhigh 的水平跟 GPT 5.5 xhigh 差不多,比起 5.6 sol Extra high 还差了点,5.6 应该跟 fable 放一起比。至于对抗式审查完全可以自动化,我现在的流程是开发完直接拉起 CR,用 codex 起各种 subagent 和 cli 调其他模型一起审,这根本不需要人去干预,不耗费心力。

· 0 个赞

好奇佬的 workflow 模式是如何实现的,我好像没碰到这个工作流。我目前是两者都在混用,谁额度有空余用谁。两者通过 docs 进行信息传递。

· 0 个赞

感觉在浪费 tokens ,相比没有 workflow 的 gpt 没有明显差距。即使是没有 workflow 的 gpt 能发现 ultracode 的 fable 没发现的问题。

· 0 个赞

codex 你也可以让它不断派发 subAgent 进行对抗审查的。

· 0 个赞

再问大家一个问题哦,我从来没用过 codex 和 claude 的 goal 模式,这个收益如何啊,大家都用在什么情况下。

· 0 个赞