xby-asr-5
在终端中运行以下命令:
dsh plugin install xby-skill/xby-asr-5
将以下提示词粘贴到 DeepSeek Harness 对话框中:
在终端执行 dsh plugin install xby-skill/xby-asr-5 即可安装,插件源码位于 https://github.com/xby-skill/xby-asr-5 。
插件介绍
在 DeepSeek Harness 的日常对话中处理多语种语音转文字,往往要来回切换模型、手动指定语种、反复调试输入格式。xby-asr-5 把这些琐碎步骤收敛为一次调用:内置普通话、英语、日语、韩语、粤语五种识别能力,模型自动判断语种,无需用户额外标注。
核心能力围绕三种音频输入方式展开——URL 链接、BASE64 编码、本地文件路径,覆盖了从网页抓取到本地离线处理的主要场景。底层采用 int8 量化的 SenseVoice 模型,在保持多语种识别精度的同时降低了推理开销。API 密钥在会话中一次性设置后即可持久化,重启不必重复配置。
适合需要频繁处理多语种语音内容的创作者、跨国团队协作场景,以及希望在自己工作流中嵌入轻量 ASR 能力的开发者。无需自己维护模型部署,一次配置即可完成识别。
使用场景
- 将网页或本地录音快速转为文字
- 多语种会议录音自动识别并转写
- 在现有工作流中嵌入轻量级语音转文本
适合人员
- 需要频繁处理多语种语音内容的创作者
- 跨国团队中负责转写与翻译的协作成员
- 希望快速集成 ASR 能力而不自行部署模型的开发者