现在哪个平台的模型 API 不卡顿、不限流?

发布于

阿里云不用提了,之前买 coding plan 反复遇到限流,后来放弃阿里云了。

前面两个月在用腾讯云(没买套餐,按调用量计费,主要用 hy3 和 glm-5.2 模型),这两周也开始 429 了。我理解这是算力紧张的结果。

那么,现在还有哪个平台的模型能流畅提供服务?

刚开始尝试火山方舟(用多少付多少),效果还要观察(之前买过他家的 coding plan 也是限流,用了半个小时就退款了)。

---

原文链接:[点击查看](https://www.v2ex.com/t/1227844)

评论(8)

做一些简单任务的时候,我都是用 DeepSeek 接入 Claude Code,按量付费,用多少算多少。

· 0 个赞

国内大模型的官方套餐基本都会限流的,如果实在受不了,可以考虑用 API 中转站,一般企业版是不限制 RPM 的。

· 0 个赞

感觉 Codex 一直挺稳定的,没怎么遇到过卡顿。

· 0 个赞

可以试试 cursorbyok 这个插件,搭配 API 中转站用体验很棒,大家可以参考一下。

· 0 个赞

你可以去试试 tokenrouter.com 的 API,感觉还行,而且最近他们家调用 GLM-5.2 模型正好在打 4 折。

· 0 个赞

无语了兄弟们,刚去试了下火山方舟又 429 了,直接报 exceeded retry limit, last status: 429 Too Many Requests。下面是 request id:0217842077782925fc9fc3c0c40d4ed9ed09f6d5661eacc99a2d9

· 0 个赞

Kimi 的高速版我一直在用,基本没怎么见过报 429 错误的。不过据说他们马上要发新模型了,参考以往经验,每次发新版那几天服务都有点顶不住容易挂。

· 0 个赞

可以考虑搞搞中转站的 GPT,一般限流没那么严。

· 0 个赞