DSH Plugins
返回列表
dsh-voice

dsh-voice

模型推理 更新于 2026.08.25

在终端中运行以下命令:

dsh plugin install haoku123/dsh-voice

将以下提示词粘贴到 DeepSeek Harness 对话框中:

在 DeepSeek Harness 中,可以通过运行命令 dsh plugin install haoku123/dsh-voice 安装插件,完整源码地址为 https://github.com/haoku123/dsh-voice。

插件介绍

dsh-voice 插件旨在解决语音交互中的延迟与打断难题,为 DeepSeek Harness 带来全双工语音模式。传统语音助手往往需要等待对方说完才能回应,而这个插件通过流式 ASR → LLM → TTS 架构,实现了近乎实时的对话体验——用户说话时,系统可以一边听、一边处理、一边合成语音回复,并支持真正的“打断”功能:当用户再次开口时,助手会立即停止播放并转向处理新的输入。其核心能力包括按键说话(press-to-talk)、实时字幕显示、基于 SenseVoice 的中文优化语音识别(带标点和逆文本正则化),以及三层打断检测机制(清除播放队列、提升合成任务 epoch、取消运行中的回复)。插件还通过缓存代理和增量解码优化性能,确保流畅的多轮语音交互。适合需要自然语音交互的开发者、AI 应用构建者,以及任何希望为 DeepSeek Harness 添加高质量中文语音能力的用户。

截图预览

使用场景

  • 在语音助手对话中实现实时交互与打断。
  • 为AI应用添加语音输入输出功能。
  • 生成带实时字幕的流式语音回复体验。

适合人员

  • 语音应用开发者与集成者。
  • 需要中文优化语音功能的AI构建者。
  • AI爱好者和交互设计研究者。