DSH Plugins
返回列表
🖥️

dsh-voice-kit

客户端 更新于 2026.08.26

在终端中运行以下命令:

dsh plugin install aaaadrop/dsh-voice-kit

将以下提示词粘贴到 DeepSeek Harness 对话框中:

在终端中执行 dsh plugin install aaaadrop/dsh-voice-kit,该插件源码地址为 https://github.com/aaaadrop/dsh-voice-kit,安装后重启 DSH Desktop 并刷新 Web 界面即可使用。

插件介绍

DeepSeek Harness 的 Web 界面始终是纯文本交互:输入靠打字,阅读靠眼睛。长时间与模型对话容易产生手部疲劳,而较长的回复又容易被略读。dsh-voice-kit 把真正的语音交互带入 DSH:输入框旁出现麦克风按钮,口述内容在主机构端转写后追加到草稿中,绝不覆盖已有文字;每条助手消息尾部新增朗读按钮,一键即可收听。

朗读提供三档引擎,适配不同网络环境。Microsoft 神经声音免费且自然,通过 msedge-tts 本地合成并缓存,在受限网络下自动走系统代理;云端神经声音接入 SiliconFlow CosyVoice2 或任意 OpenAI 兼容语音服务,大陆直连无需代理,且与语音识别共用同一密钥;系统声音则完全离线,任何环境均可用。播放按句边界流式分块,首块约一秒内出声,后续块边下边播;Markdown 与 emoji 在朗读前自动剥离,视窗自动滚动至当前消息,屏幕气泡实时显示正在朗读的内容。

该插件适合希望减少打字负担、解放双手收听长回复、或在代理环境下仍保持流畅语音工作流的 DSH Desktop 用户。语音识别支持浏览器 Web Speech API 与主机端 OpenAI 兼容转写服务两条路径;设置面板内置一键预设、引擎可达性探测和密钥状态指示,排障不再靠猜。

使用场景

  • 长时间与 AI 对话时减少打字疲劳,用口述代替逐字输入
  • 解放双手收听助手长回复,通勤或休息时也能消化内容
  • 代理或受限网络下仍能通过三种引擎获得可用的语音体验

适合人员

  • DSH Desktop 每日重度用户,希望降低输入体力成本
  • 需要免打字交互的无障碍或手部不便用户
  • 在代理/受限网络下仍需本地或云端 TTS 与 ASR 的用户