DSH Plugins
返回列表
dsh-voice-input

dsh-voice-input

模型推理 更新于 2026.09.12

在终端中运行以下命令:

dsh plugin install QDchuan/dsh-voice-input

将以下提示词粘贴到 DeepSeek Harness 对话框中:

在 DeepSeek Harness 终端中执行 dsh plugin install QDchuan/dsh-voice-input 即可安装语音输入插件,源码仓库地址为 https://github.com/QDchuan/dsh-voice-input 。

插件介绍

打字慢、在语音转写工具和编辑器之间来回切换再复制粘贴,是日常使用 DeepSeek Harness 时一个小但持续的摩擦。dsh-voice-input 把这一步压缩成一个手势:输入框左侧多一个麦克风按钮,说完话转写结果直接落进输入框,全程不离开页面。录音时输入框上方浮出实时状态条,显示电平、计时、边说边出的文字,以及完成和取消按钮。\n\n引擎有两条路径。零配置路径调用浏览器自带语音识别,适合 Chrome 或 Edge 用户随手快速听写;高质量路径对接任何实现 OpenAI 转写协议的服务,硅基流动、Groq、本地 whisper.cpp、faster-whisper-server 等点一颗预设即可。设置页内置一键本机后端面板,通过自带 PowerShell 脚本完成 Whisper 安装、Ollama 启动、模型拉取,日志实时回显到界面,无需打开终端。API Key 每次转写从 DSH 凭证库按需读取,配置文件里永远没有明文,轮换 Key 对下一次录音立即生效。\n\n插件对不支持的场景也讲得清楚:选中 Ollama 后会逐个检查本机模型的音频能力,没有可听音频的模型就给出红字结论并附一键切回本机 Whisper 的按钮。内置 voice_input_status 工具让你直接问模型语音输入为什么没反应,它读出实际配置并指出该改哪一项。适合频繁输入长段落、希望完全离线听写、或想省掉打字这一步的用户。

截图预览

使用场景

  • 写长段落时直接说话,省去逐字打字
  • 完全离线环境下用本机 Whisper 完成听写
  • 在 Chrome 里随手用浏览器引擎快速转写一句话

适合人员

  • 频繁输入长段落的 Harness 用户
  • 需要完全离线听写方案的开发者
  • 想减少打字、用语音替代键盘的用户