AI-Token 消耗,为啥跟流水一样。。。。。

发布于

llfworker:

是错觉还是有问题呢?应该怎么处理?是上下文太长了吗?

---

原文链接:[点击查看](https://www.v2ex.com/t/1228479)

评论(13)

楼主是不是一个 session 从头用到尾?那 token 消耗肯定跟流水一样啊,而且聊得越久,上下文越长,消耗越快。

· 0 个赞

回复

大家不都是这么用的吗?有时候一个任务一跑就是好几个小时,这中间也没法随时切对话吧?

· 0 个赞

回复

那意思是我得不停地手动去切换 session 吗?

· 0 个赞

就算你一个 session 用到死,按理说命中缓存的部分应该挺多啊。你不去看看这消耗的 token 里,到底有多少是命中缓存的吗?

· 0 个赞

会用和不会用差距太大了。楼主也没说自己用的是什么模型、什么工具,感觉不像真心想找原因,就是纯吐槽发泄。

· 0 个赞

回复

难道不同模型表现还不一样?我现在用的是 fable5 和 GPT-5.5。吐槽没啥用啊,还是希望能有办法解决。

· 0 个赞

我用 GPT-5.6 也是一直可着一个对话框用到黑啊……原来还要时不时开新对话吗?学到了。

· 0 个赞

建议根据任务的难度,适当把思考程度调低点,比如用 medium 或者 high 应付日常。另外别在一个会话里硬聊太长,和当前上下文无关的问题赶紧开新对话。如果用的模型本身够强,就别开什么特殊技能了。

· 0 个赞

哎,上周我感觉供应商给我多算了 5 个 token 的消耗,周末都没休息好。大佬们,这 5 个 token 的账该怎么维权啊?

· 0 个赞

如果跟上下文关系不大的话,建议多切切 session,会好一点。

· 0 个赞

你的感觉没错,调用 API 的 token 消耗本来就跟喝水用电上网流量一样,用一点扣一点。

· 0 个赞

这真不是错觉。如果觉得烧得太快,可以先关掉 AI 功能试试。

· 0 个赞

不是错觉,Token 确实跟流水一样,主要是每次对话都要把之前的上下文重新传一遍。如果是轻度需求,直接用官方网页版可能更省心一点。

· 0 个赞