DSH Plugins
返回列表
dsh-guarded-live-voice

dsh-guarded-live-voice

admin-security 更新于 2026.08.26

在终端中运行以下命令:

dsh plugin install Jstn-1g/dsh-guarded-live-voice

将以下提示词粘贴到 DeepSeek Harness 对话框中:

在 DeepSeek Harness 中执行 dsh plugin install Jstn-1g/dsh-guarded-live-voice 即可安装该插件,源码见 https://github.com/Jstn-1g/dsh-guarded-live-voice

插件介绍

DSH 的语音输入此前只有简单的「按住说话转文字」按钮,缺乏双向音频回路、会话级授权绑定和权限围栏。DSH Live Voice 填补了这一空白:它围绕一次有边界的语音回合构建——你说一句话,听到返回的合成语音,审阅双方转录,再决定是否把文字放进当前草稿。整个过程绝不替你提交 composer、不替你调用任何工具,把执行权始终留在你手上。

核心体验建立在一套「guarded consent」安全架构之上:consent 显式绑定到当前精确的 DSH Session 与 Workspace,凭据解析发生在用户可见的接受动作之后;传输层通过 loopback、同源、可信 Host、连接数等多重围栏约束;协议解析采用 fail-closed 策略,socket、定时器与会话状态在回合结束时确定性拆除。输入侧将浏览器音频降混并重采样为 PCM16 单声道 16 kHz,输出侧以 24 kHz 有序播放,两侧均设有背压上限与超时熔断,确保资源不泄漏。

它适合希望在自己的 DSH Web 工作流中体验双向语音交互、同时要求每一步授权可见、权限可审计的用户和开发者。如果你追求连续对话、打断(barge-in)或让语音直接触发工具调用,这不是目标——DSH Live Voice 刻意将自身锁定在「单次回合、仅写草稿」的边界内,让安全架构先于功能扩张落地。

截图预览

使用场景

  • 在 DSH Web 工作流中完成一次有边界的双向语音回合
  • 审阅双方转录后选择性将文字写入当前草稿,不自动提交
  • 在合成与假 Provider 环境中验证授权绑定与权限围栏流程

适合人员

  • 在 DSH Web 中需要语音输入且要求每步授权可见的用户
  • 关注插件安全边界、权限围栏与 fail-closed 拆除的开发者
  • 希望评估双向语音方案但要求不自动提交、不调用工具的团队