DSH Plugins
返回列表
🤖

dsh-voice

模型推理 更新于 2026.08.27

在终端中运行以下命令:

dsh plugin install GooDAnDReaDY/dsh-voice

将以下提示词粘贴到 DeepSeek Harness 对话框中:

从开源地址 https://github.com/GooDAnDReaDY/dsh-voice 获取源码后,在终端执行 dsh plugin install GooDAnDReaDY/dsh-voice 完成安装,随后重启 DSH Web UI 并刷新浏览器即可使用。

插件介绍

在 DeepSeek Harness 的 Web UI 里,长时间打字撰写提示词既耗时又容易错过转瞬即逝的灵感。dsh-voice 把完整的语音输入管线直接嵌进聊天界面:流式听写按呼吸自然停顿自动断句并实时灌入编辑器,语音消息录完后可一键发送或丢弃,鼠标推按和键盘 Ctrl 推按让双手彻底离开键盘。

更关键的是它的多引擎回退链。Browser Web Speech API 提供零延迟本地识别,Deepgram、Groq、HuggingFace、OpenAI、SiliconFlow 等云端引擎按需热切换,whisper.cpp 与 SenseVoice-ONNX / Sherpa-ONNX 则保证完全离线、零网络依赖的私有转录。任意一层额度用完或 429 限流时,请求自动滑到下一层,语音流不会中断。草稿中的代码变量和标识符还会被自动提取并注入 STT 上下文,显著提升技术术语的识别准确率。Agent 端通过 transcribe_audio 工具可直接分析磁盘上的录音文件,WebSocket 实时桥接则支持 OpenAI Realtime API 的低延迟双向音频流。

它适合三类人:重度使用 DeepSeek Harness 撰写长提示词、希望用口述替代打字的开发者;对数据隐私敏感、需要完全离线或内网部署语音识别的团队;以及希望在多个云端/本地引擎之间建立冗余保障、确保语音输入永不掉线的生产环境用户。

使用场景

  • 在 Harness Web UI 中用口述替代打字,实时将语音灌入提示词编辑器
  • 离线或内网环境下用 whisper.cpp / SenseVoice-ONNX 完成完全私有的语音转录
  • 在 Deepgram、Groq、whisper 等多个引擎间建立冗余回退,额度耗尽时语音流不中断

适合人员

  • 重度使用 DeepSeek Harness 撰写长提示词、希望口述替代打字的开发者
  • 对数据隐私敏感、需要完全离线或内网语音识别的团队
  • 在多个云端与本地 STT 引擎间建立冗余、确保语音输入零中断的生产环境用户