dsh-ears — 给 DeepSeek 加一对耳朵

发布于

![image](http://pic.zhso.org/2026/08/19/78c8a5c39dd1.png)

写了个 dsh 的语音输入插件 **dsh-ears**,使用 ASR 模型进行语音转写,还能用 dsh 里已经接好的模型自动润色——去口头禅、修错字、把口语整理甚至自定义系统提示词。

## 演示

![image](http://pic.zhso.org/2026/08/19/fc32beff34c0.png) ![image](http://pic.zhso.org/2026/08/19/57cb363f8a90.png)

## 安装

```
dsh plugin --profile web add dsh-ears
```

**GitHub:** [https://github.com/WizisCool/dsh-ears](https://github.com/WizisCool/dsh-ears)

一行搞定,刷新页面输入框旁边就多了个麦克风。

## 识别后端

目前支持的识别后端,欢迎提 PR 扩展更多后端:

- **Groq** — 免费
- **阿里云百炼** — 原生 DashScope API 调用,有免费额度
- **本地 Whisper** — 插件预装 openai-whisper
- **Web Speech** — 浏览器原生
- **自定义 OpenAI 兼容接口**

## 润色

这个是比较实用的功能。转写完的文字往往有口头禅、语气词、说错又纠正的内容,直接发出去浪费 token 也导致模型多思考乱猜。插件可以调 dsh 里已经配好的任意模型做一遍润色,提示词可以自定义,也可以用内置的默认提示词。

润色走的是 dsh 自己的模型路由,不需要额外配 key。

求个 Star🌟 [GitHub](https://github.com/WizisCool/dsh-ears)

欢迎 Issue / 提 PR。如果有在用其他 ASR 服务的,也欢迎贡献新的识别后端。

---

原文链接:[点击查看](https://www.v2ex.com/t/1235546)

评论

暂无评论。

0.044277s