dsh-voice
在终端中运行以下命令:
dsh plugin install haoku123/dsh-voice
将以下提示词粘贴到 DeepSeek Harness 对话框中:
在 DeepSeek Harness 中,可以通过运行命令 dsh plugin install haoku123/dsh-voice 安装插件,完整源码地址为 https://github.com/haoku123/dsh-voice。
插件介绍
dsh-voice 插件旨在解决语音交互中的延迟与打断难题,为 DeepSeek Harness 带来全双工语音模式。传统语音助手往往需要等待对方说完才能回应,而这个插件通过流式 ASR → LLM → TTS 架构,实现了近乎实时的对话体验——用户说话时,系统可以一边听、一边处理、一边合成语音回复,并支持真正的“打断”功能:当用户再次开口时,助手会立即停止播放并转向处理新的输入。其核心能力包括按键说话(press-to-talk)、实时字幕显示、基于 SenseVoice 的中文优化语音识别(带标点和逆文本正则化),以及三层打断检测机制(清除播放队列、提升合成任务 epoch、取消运行中的回复)。插件还通过缓存代理和增量解码优化性能,确保流畅的多轮语音交互。适合需要自然语音交互的开发者、AI 应用构建者,以及任何希望为 DeepSeek Harness 添加高质量中文语音能力的用户。
截图预览
使用场景
- 在语音助手对话中实现实时交互与打断。
- 为AI应用添加语音输入输出功能。
- 生成带实时字幕的流式语音回复体验。
适合人员
- 语音应用开发者与集成者。
- 需要中文优化语音功能的AI构建者。
- AI爱好者和交互设计研究者。