豆包的文件解析是怎么做的, 我想仿照做一个

发布于

原始需求是公司员工不想读招标文件,只想摘要出其中最关键的信息,比如商品/数量/规整等等。

我自己用 rag 做了一下,感觉和豆包的解析效果差远了,我还做了很多针对性的调整。

豆包应该是一个通用的方式,是用什么方式实现的呢?我先要抄一下本地部署。

---

原文链接:[点击查看](https://www.v2ex.com/t/1227073)

评论(3)

可以让它使用 ls、find、rg(ripgrep)、grep、cat/sed 工具,让它们都开放出来。

· 0 个赞

如果写一个文件解析的 MCP 服务,把文件内容读取出来给大模型总结,应该可行吧?

· 0 个赞

回复

@yongyuanfan2 把所有内容给大模型的话,可能上下文不够,只能挑部分内容,不知道该如何选择呢。

· 0 个赞