开源视频下载器 VidBee 破 1 万 Star: 2.0 支持在本地把视频转成文稿与 AI 提问
大家好,很久之前在 V 站分享过自己写的开源视频下载器 VidBee,不知不觉在 GitHub 突破了 10k Star,非常感谢大家一直以来的支持!
前段时间周末断断续续的花了挺多精力重构并做新特性,今天正式把 2.0 版本发布了。
这次 2.0 最大的更新,是把**本地语音转写与 AI 文稿处理**做进去了——现在视频下载完,或者直接把本地音视频文件拖进来,就能在本地转成带时间戳和说话人的文稿,还能直接针对文稿问 AI 或生成摘要。
- 官网:[https://vidbee.org/](https://vidbee.org/)
- GitHub:[https://github.com/nexmoe/VidBee](https://github.com/nexmoe/VidBee)
也欢迎 Follow 关注我的 GitHub(平时会持续折腾和开源一些有趣的小工具与项目):
- 个人主页:[https://github.com/nexmoe](https://github.com/nexmoe)
---
### 本地视频转文稿:离线隐私、时间戳联动
转写全程运行在你自己的电脑上,音视频数据**完全不会上传到云端**。
- **多模型支持**:内置/支持了 Whisper、SenseVoice、Parakeet、Qwen3-ASR 等模型,软件会根据你的硬件配置给出推荐建议。中文场景推荐试试 SenseVoice 或 Qwen3-ASR,速度和准确率都很不错。如果初次下载模型较慢,可以在设置里一键切换国内镜像源。
- **定位与导出**:支持说话人分离(Diarization)。在生成的文稿里搜原话,点击对应句子就能直接跳到对应视频进度播放。支持一键复制,也可导出为 TXT、Markdown 以及 SRT/VTT 字幕。
*(文稿模块目前还在持续打磨中,界面上先标了 experimental,遇到问题欢迎轻喷反馈)*

---
### 文稿 AI 提问 & 摘要:支持本地 LLM 与云端 API
转写完成后,可以直接对文稿内容进行提问、提取核心观点或生成结构化摘要:
- **隐私安全**:发给 AI 的只是提取出来的文稿纯文本,不是原始庞大的音视频文件。
- **灵活接入**:不仅支持标准 OpenAI 格式的云端 API,也可以直接连本地跑的 **Ollama** 或 **LM Studio**。如果你想要从「转写」到「AI 总结」全程断网离线运行,配合本地大模型即可搞定。所有 API Key 都只存放在本地。

---
### 老本行:批量下载与 RSS 追更
底层的视频下载能力依旧稳定给力:
- **强大的下载支持**:基于成熟的 yt-dlp,YouTube、B 站等常见平台及支持的 1000+ 网站都能轻松加入队列排队批量下载。

- **RSS 追更订阅**:内置 RSS 抓取与追更功能,订阅创作者或频道后有新更新可以自动捕获下载。

---
### 软件下载与安装
可以到官网下载页获取 v2.0.0:[https://vidbee.org/download/](https://vidbee.org/download/)
---
如果大家在转写速度、说话人识别、模型适配或者下载体验上遇到任何 bug 或问题,欢迎直接在回帖中吐槽交流,或者去 GitHub 提 Issue / PR。项目完全开源,觉得好用的话欢迎顺手点个 Star 支持一下。
---
原文链接:[点击查看](https://www.v2ex.com/t/1236546)
前段时间周末断断续续的花了挺多精力重构并做新特性,今天正式把 2.0 版本发布了。
这次 2.0 最大的更新,是把**本地语音转写与 AI 文稿处理**做进去了——现在视频下载完,或者直接把本地音视频文件拖进来,就能在本地转成带时间戳和说话人的文稿,还能直接针对文稿问 AI 或生成摘要。
- 官网:[https://vidbee.org/](https://vidbee.org/)
- GitHub:[https://github.com/nexmoe/VidBee](https://github.com/nexmoe/VidBee)
也欢迎 Follow 关注我的 GitHub(平时会持续折腾和开源一些有趣的小工具与项目):
- 个人主页:[https://github.com/nexmoe](https://github.com/nexmoe)
---
### 本地视频转文稿:离线隐私、时间戳联动
转写全程运行在你自己的电脑上,音视频数据**完全不会上传到云端**。
- **多模型支持**:内置/支持了 Whisper、SenseVoice、Parakeet、Qwen3-ASR 等模型,软件会根据你的硬件配置给出推荐建议。中文场景推荐试试 SenseVoice 或 Qwen3-ASR,速度和准确率都很不错。如果初次下载模型较慢,可以在设置里一键切换国内镜像源。
- **定位与导出**:支持说话人分离(Diarization)。在生成的文稿里搜原话,点击对应句子就能直接跳到对应视频进度播放。支持一键复制,也可导出为 TXT、Markdown 以及 SRT/VTT 字幕。
*(文稿模块目前还在持续打磨中,界面上先标了 experimental,遇到问题欢迎轻喷反馈)*

---
### 文稿 AI 提问 & 摘要:支持本地 LLM 与云端 API
转写完成后,可以直接对文稿内容进行提问、提取核心观点或生成结构化摘要:
- **隐私安全**:发给 AI 的只是提取出来的文稿纯文本,不是原始庞大的音视频文件。
- **灵活接入**:不仅支持标准 OpenAI 格式的云端 API,也可以直接连本地跑的 **Ollama** 或 **LM Studio**。如果你想要从「转写」到「AI 总结」全程断网离线运行,配合本地大模型即可搞定。所有 API Key 都只存放在本地。

---
### 老本行:批量下载与 RSS 追更
底层的视频下载能力依旧稳定给力:
- **强大的下载支持**:基于成熟的 yt-dlp,YouTube、B 站等常见平台及支持的 1000+ 网站都能轻松加入队列排队批量下载。

- **RSS 追更订阅**:内置 RSS 抓取与追更功能,订阅创作者或频道后有新更新可以自动捕获下载。

---
### 软件下载与安装
可以到官网下载页获取 v2.0.0:[https://vidbee.org/download/](https://vidbee.org/download/)
---
如果大家在转写速度、说话人识别、模型适配或者下载体验上遇到任何 bug 或问题,欢迎直接在回帖中吐槽交流,或者去 GitHub 提 Issue / PR。项目完全开源,觉得好用的话欢迎顺手点个 Star 支持一下。
---
原文链接:[点击查看](https://www.v2ex.com/t/1236546)
· 0 个赞