DSH Plugins
返回列表
🖥️

dsh-voice

客户端 更新于 2026.08.18

在终端中运行以下命令:

dsh plugin install zhuiyueya/dsh-voice

将以下提示词粘贴到 DeepSeek Harness 对话框中:

要在 DeepSeek Harness 中安装 dsh-voice 插件,请运行命令 dsh plugin install zhuiyueya/dsh-voice,完整源码地址为 https://github.com/zhuiyueya/dsh-voice。

插件介绍

DeepSeek Harness 是一个强大的文本 AI 助手,但其 API 仅支持纯文本交互,无法直接处理音频输入或生成语音输出,这在需要语音交互的场景中带来限制。dsh-voice 插件应运而生,为 DeepSeek Harness 添加了完整的语音能力,让用户能够通过麦克风与模型对话,并让模型朗读回复,从而在不改变模型本身的情况下扩展交互方式。

该插件的核心能力包括 Web 界面上的语音输入(STT)和语音输出(TTS)。用户点击麦克风按钮即可录音,语音通过浏览器 Web Speech API 和可配置的 Whisper 兼容后端转录为文本;每个回复旁设有朗读按钮,使用浏览器 speechSynthesis 朗读内容。此外,它提供了 voice_transcribe 和 voice_speak 两个 Agent 工具,支持转录音频文件和文本转语音,且所有功能无需 API 密钥,可搭配本地 whisper.cpp 等免费后端实现完全离线使用。

dsh-voice 适合广泛的用户群体。对于日常用户,它提供了更自然、便捷的语音交互方式,尤其适合在打字不便时使用;对于开发者和 AI 爱好者,它展示了如何在客户端边缘扩展 AI 助手的能力,适合用于本地部署或实验;对于教育或辅助技术领域,该插件能增强可访问性,帮助视障用户或语言学习者更轻松地与 AI 互动。

使用场景

  • 在不便打字时使用语音与AI对话
  • 让AI朗读回复以节省阅读时间
  • 转录音频文件进行文本分析

适合人员

  • 需要语音辅助的日常用户
  • 开发者和AI爱好者扩展功能
  • 教育工作者和学生用于语音学习