dsh-voice
在终端中运行以下命令:
dsh plugin install KotDath/dsh-voice
将以下提示词粘贴到 DeepSeek Harness 对话框中:
在任意终端中运行 dsh plugin install KotDath/dsh-voice(插件仓库:https://github.com/KotDath/dsh-voice)即可将该插件安装到当前 DSH 配置文件,随后重启 Web 进程即可对所有会话生效。
插件介绍
DeepSeek Harness 的 Web 界面一直缺少原生的语音输入能力,长时间打字效率低下且容易疲劳。dsh-voice 插件在发送按钮旁加入一枚麦克风图标,点击后弹出 ChatGPT 风格的录音药丸,提供取消、仅插入文字、直接发送三种操作,让语音成为与键盘同等自然的输入方式,全程无需切换应用。
转写层面,插件内置三套可切换引擎:默认使用 transcribe.cpp(含 GigaAM v3、Voxtral Mini、Whisper large-v3 等 67 个模型,支持一键从 Hugging Face 下载并带进度条);本地离线场景可切换到 whisper.cpp 搭配任意 GGML 模型;企业或云端环境则直接对接 OpenAI 兼容的 /v1/audio/transcriptions 接口。对于超过 22 秒的长录音,插件会自动切分为 20 秒片段、单次批量转写并拼接完整文本,避免模型窗口截断丢失内容。波形以竖条实时滚动呈现,历史信号淡化为点状基线,视觉反馈清晰。
适合需要高频语音输入的 DSH 用户:追求高质量识别且希望完全离线的开发者、依赖私有或第三方 ASR 服务的企业团队,以及希望把语音习惯无缝带入 DeepSeek 工作流的日常使用者。安装后对所有会话生效,无需逐会话配置。
使用场景
- 在 DSH Web 界面中用语音代替键盘快速输入长提示词
- 离线环境下用 transcribe.cpp 或 whisper.cpp 完成高质量本地转写
- 企业场景对接 OpenAI 兼容的私有 ASR 服务进行语音转文字
适合人员
- 偏好语音交互、希望减少打字的 DSH 日常用户
- 需要离线或本地推理、不想上传音频的开发者
- 已有私有或云端 ASR 基础设施的团队