dsh-asr-voice
在终端中运行以下命令:
dsh plugin install bitterSmilezzz/dsh-asr-voice
将以下提示词粘贴到 DeepSeek Harness 对话框中:
在 DeepSeek Harness 中执行 dsh plugin install bitterSmilezzz/dsh-asr-voice 即可从 https://github.com/bitterSmilezzz/dsh-asr-voice 安装语音输入插件,无需额外构建步骤。
插件介绍
对着麦克风说出想法,得到的却是一段需要反复擦除、断句、补标点的粗糙口语——这是大多数语音输入工具的终点,也是 dsh-asr-voice 的起点。这个 DeepSeek Harness 客户端插件把「开口」和「可直接发送的提示词」之间的鸿沟压缩到几乎消失:语音转写后由 LLM 在后台无声润色,清洗版先落到草稿、优化版完成再自动替换,你的手动编辑永远不会被覆盖。
识别引擎采用混合策略:浏览器 Web Speech API 优先(免费、免 key),不可用时自动回落到云端,且同时支持 OpenAI、Groq、硅基流动、小米 MiMo、通义 Qwen-ASR 等多家供应商并存。设置页是一张三步向导——选方式、点服务商、看密钥状态——配过同名 LLM 凭据的用户几乎无需再输入任何 key。更值得一提的是实时语音对话模式:边说边上字幕,停顿即自动发起 agent 回合,回复按句朗读,念完麦克风自动还回来听下一句;半双工设计保证朗读期间不会误收回声,按钮、快捷键、提示条三处都能随时打断。
如果你是习惯「说比写快」的人、在多个 ASR / LLM 供应商之间切换、或者希望语音输入体验接近 Codex 那种顺滑但又不想被单一服务锁定,dsh-asr-voice 是一个零第三方运行时依赖、可单独使用也可与其他插件组合的轻量选择。隐私方面,API key 只落在 DSH 凭据服务,浏览器端永远只看到「已配置 / 未配置」,录音在本地完成格式转换后才经私有代理上传。
截图预览
使用场景
- 对着麦克风说出想法,插件自动转写并在后台润色为可直接发送的提示词
- 开启实时语音对话,边说边上字幕,停顿即触发 agent 回合,回复按句朗读后自动还麦
- 在 OpenAI、Groq、硅基流动、小米 MiMo、通义等多家 ASR 供应商间切换,配过同名 LLM 凭据即可免 key 使用
适合人员
- 习惯用语音而非键盘输入提示词、追求「开口即成文」体验的用户
- 在多个 ASR 或 LLM 供应商之间切换、不想被单一服务锁定的开发者
- 追求接近 Codex 语音输入顺滑度且重视密钥隐私的 DeepSeek Harness 用户


