dsh-voice-webspeech
在终端中运行以下命令:
dsh plugin install anweat/dsh-voice-webspeech
将以下提示词粘贴到 DeepSeek Harness 对话框中:
在 DeepSeek Harness 终端中执行 dsh plugin install anweat/dsh-voice-webspeech 即可安装,插件源码仓库地址为 https://github.com/anweat/dsh-voice-webspeech ,安装完成后重启 dsh web,输入框工具行左侧将出现麦克风按钮供按住说话。
插件介绍
DSH Web GUI 一直缺少一个轻量、开箱即用的语音输入方案。社区里常见的 dsh-voice-funasr 依赖本地 Python 环境并需下载约 520 MB 的 FunASR 模型,对只想在浏览器里用嘴写作的用户来说安装链路过重。dsh-voice-webspeech 走的是更轻的路径:完全依托浏览器内置的 Web Speech API(Edge 对应 Azure 语音、Chrome 对应 Google 语音),零服务端、零 API Key、零模型下载、零 Python,装完即可使用。
核心体验围绕输入框旁的麦克风按钮展开:按住开始聆听、松手停止,期间连续短句自动累积;聆听时按钮上方悬浮显示实时识别文字,可一键关闭。识别结果默认追加写入输入框供编辑后再发送,也可在设置中切换为松手即自动发送,适合免提场景。支持中文普通话、粤语、繁体、英、日、韩、法、德、西、俄等多语言,偏好保存在浏览器本地。
适合在 Edge 或 Chrome 中希望快速语音输入、又不想维护本地 ASR 引擎与模型的用户。音频直接交给浏览器语音服务,不经过 DSH 服务端、不落盘、无遥测,隐私透明。注意 Firefox 与 Safari 因不支持 Web Speech API 暂无法使用。
截图预览
使用场景
- 在 DSH Web GUI 中通过语音快速输入提示词,免去打字
- 免提模式下按住麦克风说话、松手自动发送消息
- 在 Edge 或 Chrome 中用中文、英文等多语言进行语音转文字
适合人员
- 希望开箱即用、不想安装 Python 或下载数百 MB 模型的用户
- 使用 Edge 或 Chrome 浏览器并已获得麦克风权限的开发者
- 偏好音频不经过任何第三方服务端、注重本地隐私的用户
