xby-asr-zh
在终端中运行以下命令:
dsh plugin install xby-skill/xby-asr-zh
将以下提示词粘贴到 DeepSeek Harness 对话框中:
在 DeepSeek Harness 中运行 dsh plugin install xby-skill/xby-asr-zh 即可安装该插件,源码位于 https://github.com/xby-skill/xby-asr-zh
插件介绍
在 DSH 日常对话中,你经常需要把一段中文语音转成文字,却不得不切换到外部工具、手动上传文件再等结果。xby-asr-zh 把这件事拉回了对话本身:一句指令,音频进、文字出,省去来回切换的麻烦。
底层跑的是 Paraformer INT8 量化模型,识别速度快、资源占用低,专为中文场景调优。输入方式做了三种适配——直接贴一条音频 URL、传入 Base64 编码、或给出本地文件路径,无论音频此刻在哪种形态,都能一键喂给模型。API 密钥只需在聊天里设置一次,插件会自动持久化,重启 DSH 后依然有效,不必反复配置。
适合的场景很明确:你在做语音助手、会议纪要整理、播客转录,或者只是想在对话中快速把一段中文录音转成文本,又不想离开 DSH 的工作环境。装好插件、设好密钥,后续每次识别就是一次函数调用。
使用场景
- 在 DSH 对话中快速将一段中文语音转成文字,免去切换外部工具的麻烦
- 将会议纪要、播客等中文音频批量转录为可搜索文本,方便后续编辑和检索
- 开发语音助手或智能客服时,在流水线中直接调用中文识别接口,无需额外部署服务
适合人员
- 日常使用 DSH、需要频繁处理中文语音内容的开发者
- 构建中文语音助手或智能客服、希望减少模型部署环节的工程师
- 在对话工作流中嵌入语音转文字能力、追求开箱即用的技术团队