真的不建议任何人用中转 2
前文: [上篇链接](https://v2ex.com/t/1205344)
上次聊的是价格和安全性,这次说说使用体验。
> 文章中的中转特指各种类型的廉价中转,不包括 openrouter / cloudflare ai gateway 之类的商业中转。
自从 GPT 5.6 发布以后,Pro 20x 已经不够用了,于是我开始尝试一些中转,以作为套餐耗尽时的补充,体验就两个字:糟糕。
**问题一:速度**
首先,最大的问题就是速度。GPT 5.6 Sol 官方的平均 TTFT 大概是在 3-4 秒,但中转的往往慢上好几倍。我尝试了几个中转,普遍的平均 TTFT 都能达到 10 秒以上,甚至有遇到过一些请求偶尔能达到 2 分钟的情况。
对于编程会话,一个小任务的 prompt 至少有 20 轮左右的工具调用,单纯因为中转的开销就达到了数分钟。实际上,我的体验中,平均数值的意义并不大,反而是长尾延迟将中转带来的时间成本放大得更为明显,可能一个官方 API 10 分钟能完成的任务,中转却可能要半小时甚至更久。
可笑的是,一些中转声称可以使用 /fast —— 参照官方收取了 2.5 倍的价格,但实际上并没有达到所谓的 Fast 效果,因为中转场景中的真正时间成本主要是中转本身带来的,而非模型推理。
至于速度慢的原因,我猜测一方面可能是中转带宽或硬件资源在高峰期不足,另一方面则可能是请求遇到了频繁换号的情况。
**问题二:缓存命中率**
OpenAI 的缓存读取费用是 0.1 倍、缓存写入费用是 1.25 倍。我们在自己的账号上可以充分享受到缓存带来的价格优势(或许也有速度优势),但中转背后是若干个官方账号组成的号池,你的请求会被路由到某一个账号上,而缓存跨账号是无效的,因此中转的换号必然导致缓存失效,这直接将本该 0.1 倍的请求计费变成了 1.25 倍,中间的费用差竟然达到 12 倍。
最不幸的是,号池换号频繁,特别是低价中转通常使用的是 Plus / Team 号池,一个号供一个人使用尚且不够,更何况是多人共享。OpenAI 的缓存有效期是 24 小时,在这 24 小时内本该可以利用缓存,却变成了重建缓存,几次请求的开销就可能翻倍。
**问题三:稳定性**
这里的稳定性我们不讨论中转本身没有号的情况(事实上大型中转应该不会遇到这种情况),主要是说 Agent 稳定完成一个任务的可能性。
Codex 对各种官方错误处理得很好,除了真正无法恢复的(如安全错误、用量耗尽)外,其他都会有自动重试机制,基本可以保证一个任务能够稳定完成。
但中转通常无法复刻官方的错误码,这基本直接导致了一些中转出错,或者中转到 OpenAI 服务器的临时性错误,最终变成了 Codex 认为无法恢复的错误,导致任务执行过程中断。有时候停止时还会报错,有时候看似“任务完成”但其实并没有。
另外,Codex 内部实际上有个最大并发任务数的限制,这在个人账户里几乎不可能遇到,但中转的确有可能会遇到,如果出现则又会导致 Codex 认为是不可恢复的错误,任务也会被终止。
---
原文链接:[点击查看](https://www.v2ex.com/t/1232923)
上次聊的是价格和安全性,这次说说使用体验。
> 文章中的中转特指各种类型的廉价中转,不包括 openrouter / cloudflare ai gateway 之类的商业中转。
自从 GPT 5.6 发布以后,Pro 20x 已经不够用了,于是我开始尝试一些中转,以作为套餐耗尽时的补充,体验就两个字:糟糕。
**问题一:速度**
首先,最大的问题就是速度。GPT 5.6 Sol 官方的平均 TTFT 大概是在 3-4 秒,但中转的往往慢上好几倍。我尝试了几个中转,普遍的平均 TTFT 都能达到 10 秒以上,甚至有遇到过一些请求偶尔能达到 2 分钟的情况。
对于编程会话,一个小任务的 prompt 至少有 20 轮左右的工具调用,单纯因为中转的开销就达到了数分钟。实际上,我的体验中,平均数值的意义并不大,反而是长尾延迟将中转带来的时间成本放大得更为明显,可能一个官方 API 10 分钟能完成的任务,中转却可能要半小时甚至更久。
可笑的是,一些中转声称可以使用 /fast —— 参照官方收取了 2.5 倍的价格,但实际上并没有达到所谓的 Fast 效果,因为中转场景中的真正时间成本主要是中转本身带来的,而非模型推理。
至于速度慢的原因,我猜测一方面可能是中转带宽或硬件资源在高峰期不足,另一方面则可能是请求遇到了频繁换号的情况。
**问题二:缓存命中率**
OpenAI 的缓存读取费用是 0.1 倍、缓存写入费用是 1.25 倍。我们在自己的账号上可以充分享受到缓存带来的价格优势(或许也有速度优势),但中转背后是若干个官方账号组成的号池,你的请求会被路由到某一个账号上,而缓存跨账号是无效的,因此中转的换号必然导致缓存失效,这直接将本该 0.1 倍的请求计费变成了 1.25 倍,中间的费用差竟然达到 12 倍。
最不幸的是,号池换号频繁,特别是低价中转通常使用的是 Plus / Team 号池,一个号供一个人使用尚且不够,更何况是多人共享。OpenAI 的缓存有效期是 24 小时,在这 24 小时内本该可以利用缓存,却变成了重建缓存,几次请求的开销就可能翻倍。
**问题三:稳定性**
这里的稳定性我们不讨论中转本身没有号的情况(事实上大型中转应该不会遇到这种情况),主要是说 Agent 稳定完成一个任务的可能性。
Codex 对各种官方错误处理得很好,除了真正无法恢复的(如安全错误、用量耗尽)外,其他都会有自动重试机制,基本可以保证一个任务能够稳定完成。
但中转通常无法复刻官方的错误码,这基本直接导致了一些中转出错,或者中转到 OpenAI 服务器的临时性错误,最终变成了 Codex 认为无法恢复的错误,导致任务执行过程中断。有时候停止时还会报错,有时候看似“任务完成”但其实并没有。
另外,Codex 内部实际上有个最大并发任务数的限制,这在个人账户里几乎不可能遇到,但中转的确有可能会遇到,如果出现则又会导致 Codex 认为是不可恢复的错误,任务也会被终止。
---
原文链接:[点击查看](https://www.v2ex.com/t/1232923)
· 0 个赞
· 0 个赞
· 0 个赞
· 0 个赞
· 0 个赞
· 0 个赞
· 0 个赞
· 0 个赞
· 0 个赞
· 0 个赞
· 0 个赞