DSH Plugins
返回列表
🖥️

dsh-voice

客户端 更新于 2026.08.26

在终端中运行以下命令:

dsh plugin install Lorodn4x/dsh-voice

将以下提示词粘贴到 DeepSeek Harness 对话框中:

在 DeepSeek Harness 中执行 dsh plugin install Lorodn4x/dsh-voice 即可安装该插件(源码地址:https://github.com/Lorodn4x/dsh-voice),安装后还需将 dsh-voice 加入 profile.bundles 并重启 profile。

插件介绍

DeepSeek Harness 的 Web 界面目前只有纯文本输出,长段回答或代码密集的回复逐字阅读既费眼又低效。dsh-voice 为这套对话补上了语音消息能力,让文本可以被听见。

插件分两侧工作。Node 侧注册了 voice_say 工具,agent 在对话中可自主决定是否发送语音;同时暴露 TTS 接口,文本先经过清洗,去除代码块、行内代码、URL、HTML 标签和表格标记,再交给 Microsoft Edge TTS 合成,无需任何 API 密钥,结果缓存在本地以避免重复请求。浏览器侧在每轮回答末尾渲染一个"收听"按钮和语音播放器,内置男声与女声切换,选择会记住到 localStorage;同一时刻只播放一个播放器,后台维护 30 条 blob 缓存。

如果你经常在移动端或通勤途中查阅 agent 输出、有听读习惯、或者希望减少长时间盯屏幕的疲劳,dsh-voice 是一个零配置成本的语音补充层。默认提供俄语男声和女声,其他语言可通过 Edge TTS 完整 ShortName 自由指定,只需网络能访问 speech.platform.bing.com 即可工作。

使用场景

  • 移动端或平板上免读 agent 长段回答
  • 通勤、开车途中收听 agent 输出
  • 减少长时间盯屏幕造成的视觉疲劳

适合人员

  • 日常使用 DeepSeek Harness Web GUI 的用户
  • 偏好听读、希望降低屏幕使用时间的用户
  • 需要零配置、无 API 密钥语音合成方案的用户