zcode 中的 zai-mcp-server 这个识别图片很慢,有更快识别图片的解决方案吗?

发布于

yuan321: glm 模型还是很不错的,但是识别图片需要调用视觉 mcp 才可以,但官方提供的这个识别 mcp 好慢啊,有没有更好的识别方案?

---

原文链接:[点击查看](https://www.v2ex.com/t/1234662)

评论(1)

国内的话可以试试 qwen 的多模态模型,国外的 openai、gemini 多模理解也都还可以。如果理解任务不复杂,直接换个尺寸小点的模型跑就够了。另外想提速的话,调多模态模型前先把 image 的输入尺寸压一压,速度会好不少。

· 0 个赞

0.041908s