dsh-voice-input-cn
在终端中运行以下命令:
dsh plugin install Schumchanvi/dsh-voice-input-cn
将以下提示词粘贴到 DeepSeek Harness 对话框中:
在 DeepSeek Harness 终端中执行 dsh plugin install Schumchanvi/dsh-voice-input-cn 即可安装,插件源码见 https://github.com/Schumchanvi/dsh-voice-input-cn 。
插件介绍
原版语音输入插件依赖 Google Web Speech API,在国内网络环境下完全无法访问。dsh-voice-input-cn 将识别引擎重写为阿里云 DashScope ASR,并引入一个本地 Python bridge 负责 SDK 层面的 WebSocket 鉴权,让国内用户也能真正使用语音输入。
核心体验:点击聊天框旁的麦克风按钮开始说话,识别文字以流式方式实时填入光标位置,不覆盖已有草稿;停顿 1.5 秒自动停止录音。支持中/English 切换,可选识别后自动发送。bridge 仅监听 127.0.0.1,音频只发送至阿里云 DashScope 做识别,不上传任何第三方,不暴露公网。
如果你在国内使用 DeepSeek Harness,习惯用语音口述长提示或消息而非打字,这个插件用一条低延迟的国内直连链路补上了语音输入的缺口。
使用场景
- 国内用户在 DSH 聊天框中语音口述长提示词而不打字
- 快速录入中文消息,识别文字实时填入光标位置
- 替代无法直连的 Google Web Speech API,走阿里云 DashScope 完成语音识别
适合人员
- 在国内使用 DeepSeek Harness 的中文用户
- 偏好语音口述、长时间打字的开发者
- 需要绕过 Google 服务访问限制、走国内云服务的用户