dsh-ears — 给 DeepSeek 加一对耳朵

写了个 dsh 的语音输入插件 **dsh-ears**,使用 ASR 模型进行语音转写,还能用 dsh 里已经接好的模型自动润色——去口头禅、修错字、把口语整理甚至自定义系统提示词。
## 演示
 
## 安装
```
dsh plugin --profile web add dsh-ears
```
**GitHub:** [https://github.com/WizisCool/dsh-ears](https://github.com/WizisCool/dsh-ears)
一行搞定,刷新页面输入框旁边就多了个麦克风。
## 识别后端
目前支持的识别后端,欢迎提 PR 扩展更多后端:
- **Groq** — 免费
- **阿里云百炼** — 原生 DashScope API 调用,有免费额度
- **本地 Whisper** — 插件预装 openai-whisper
- **Web Speech** — 浏览器原生
- **自定义 OpenAI 兼容接口**
## 润色
这个是比较实用的功能。转写完的文字往往有口头禅、语气词、说错又纠正的内容,直接发出去浪费 token 也导致模型多思考乱猜。插件可以调 dsh 里已经配好的任意模型做一遍润色,提示词可以自定义,也可以用内置的默认提示词。
润色走的是 dsh 自己的模型路由,不需要额外配 key。
求个 Star🌟 [GitHub](https://github.com/WizisCool/dsh-ears)
欢迎 Issue / 提 PR。如果有在用其他 ASR 服务的,也欢迎贡献新的识别后端。
---
原文链接:[点击查看](https://www.v2ex.com/t/1235546)
写了个 dsh 的语音输入插件 **dsh-ears**,使用 ASR 模型进行语音转写,还能用 dsh 里已经接好的模型自动润色——去口头禅、修错字、把口语整理甚至自定义系统提示词。
## 演示
 
## 安装
```
dsh plugin --profile web add dsh-ears
```
**GitHub:** [https://github.com/WizisCool/dsh-ears](https://github.com/WizisCool/dsh-ears)
一行搞定,刷新页面输入框旁边就多了个麦克风。
## 识别后端
目前支持的识别后端,欢迎提 PR 扩展更多后端:
- **Groq** — 免费
- **阿里云百炼** — 原生 DashScope API 调用,有免费额度
- **本地 Whisper** — 插件预装 openai-whisper
- **Web Speech** — 浏览器原生
- **自定义 OpenAI 兼容接口**
## 润色
这个是比较实用的功能。转写完的文字往往有口头禅、语气词、说错又纠正的内容,直接发出去浪费 token 也导致模型多思考乱猜。插件可以调 dsh 里已经配好的任意模型做一遍润色,提示词可以自定义,也可以用内置的默认提示词。
润色走的是 dsh 自己的模型路由,不需要额外配 key。
求个 Star🌟 [GitHub](https://github.com/WizisCool/dsh-ears)
欢迎 Issue / 提 PR。如果有在用其他 ASR 服务的,也欢迎贡献新的识别后端。
---
原文链接:[点击查看](https://www.v2ex.com/t/1235546)
评论
暂无评论。