最近 token 烧得多了,自己手搓了个智能路由 MiniRouter

发布于

最近发现一个很现实的问题:Fable 、GPT-5.6 、GLM-5.2 这些强模型真的很好用。
但如果每一次 AI 请求都调用最贵模型,账单真的扛不住。
比如:✍️ “帮我润色一句话” 📄 “总结一篇文章” 💻 “解释一段代码”
这些任务,真的需要每次都上最强模型吗?
于是我做了一个小工具:

## MiniRouter 🚀
它可以帮你自动判断任务难度,然后选择合适的模型。你只需要一个入口:
`model = minirouter/auto`
后面交给它:
🚀 简单任务 → 快模型(便宜、响应快)
⚖️ 日常开发 → 均衡模型(速度和质量平衡)
🧠 复杂推理 / 疑难排查 → 强模型(保证效果)
🖼 图片、多模态任务 → 视觉模型(适用于无 vision 能力的 LLM)

除了自动选模型,它还能帮你管理:
✅ 多模型统一 API ️
✅ OpenAI / Anthropic 兼容
✅ 多渠道自动切换
✅ API Key 和额度控制
✅ Token 、费用、延迟统计
✅ 查看每次为什么选择这个模型

简单来说:
让不同模型各司其职,而不是所有事情都用“大炮打蚊子”。
这个项目主要适合:
👨‍💻 AI 应用开发者
🤖 Agent / 工作流开发者
🏢 团队内部 AI 平台
☁️ 有多个模型订阅或 API 的用户
如果你也在折腾 AI 应用,欢迎体验。
MiniRouter 已开源:GitHub:lpffernando/MiniRouter
欢迎 Star ⭐,也欢迎交流模型调度、Agent 架构。

---

原文链接:[点击查看](https://www.v2ex.com/t/1227031)

评论

暂无评论。