dsh-voice-chat
在终端中运行以下命令:
dsh plugin install maoyuching/dsh-voice-chat
将以下提示词粘贴到 DeepSeek Harness 对话框中:
前往 https://github.com/maoyuching/dsh-voice-chat 查看 README,按指引执行 dsh plugin install maoyuching/dsh-voice-chat 即可将语音对话插件安装到 DeepSeek Harness 中。
插件介绍
DSH Web GUI 里逐字打字回复虽然方便,但长文阅读容易视觉疲劳,语音输入又缺少流畅的交互闭环。dsh-voice-chat 把「说」和「听」打通:点一下麦克风就开口,AI 回完话自动用声音汇报,体验接近豆包语音助手。
核心能力覆盖了语音输入、语音输出和引擎灵活性三个层面。输入侧支持停顿 2.5 秒自动结束并转写发送;输出侧经 TTS 合成朗读,长回复可开启转述朗读模式,由 LLM 先收敛概括再播报,不扩散不发散。ASR 引擎兼容 SiliconFlow(SenseVoice)、Groq(Whisper)、小米 MiMo 及任意 OpenAI 兼容端点;TTS 引擎支持 Edge TTS(微软免费、无需密钥)、MiMo TTS 和自定义接口。单信道播报保证同一时刻只有一种声音,防重播机制避免重进会话时重复朗读,Ctrl+Shift+Space 快捷键一键切换麦克风。
适合习惯语音交互、希望减少打字量的日常用户,也适合需要多引擎灵活切换、追求低延迟播报的开发者。所有配置在 DSH 设置面板中改完即生效无需重启,Node.js 22 以上加主流浏览器即可运行,Edge TTS 零密钥开箱即用。
使用场景
- 长时间打字回复导致视觉疲劳,改用语音输入与播报
- 通勤或做饭时免手操作,通过语音与 AI 对话
- 在统一界面中切换 SiliconFlow、Groq、MiMo 等不同 ASR/TTS 引擎做效果对比
适合人员
- 偏好语音交互、希望减少键盘打字的日常用户
- 需要灵活切换多套 ASR/TTS 引擎的开发者
- 已在使用 DeepSeek Harness Web GUI 并想增强交互体验的用户