DSH Plugins
返回列表
🤖

xby-asr-5

模型推理 更新于 2026.09.02

在终端中运行以下命令:

dsh plugin install xby-skill/xby-asr-5

将以下提示词粘贴到 DeepSeek Harness 对话框中:

在终端执行 dsh plugin install xby-skill/xby-asr-5 即可安装,插件源码位于 https://github.com/xby-skill/xby-asr-5 。

插件介绍

在 DeepSeek Harness 的日常对话中处理多语种语音转文字,往往要来回切换模型、手动指定语种、反复调试输入格式。xby-asr-5 把这些琐碎步骤收敛为一次调用:内置普通话、英语、日语、韩语、粤语五种识别能力,模型自动判断语种,无需用户额外标注。

核心能力围绕三种音频输入方式展开——URL 链接、BASE64 编码、本地文件路径,覆盖了从网页抓取到本地离线处理的主要场景。底层采用 int8 量化的 SenseVoice 模型,在保持多语种识别精度的同时降低了推理开销。API 密钥在会话中一次性设置后即可持久化,重启不必重复配置。

适合需要频繁处理多语种语音内容的创作者、跨国团队协作场景,以及希望在自己工作流中嵌入轻量 ASR 能力的开发者。无需自己维护模型部署,一次配置即可完成识别。

使用场景

  • 将网页或本地录音快速转为文字
  • 多语种会议录音自动识别并转写
  • 在现有工作流中嵌入轻量级语音转文本

适合人员

  • 需要频繁处理多语种语音内容的创作者
  • 跨国团队中负责转写与翻译的协作成员
  • 希望快速集成 ASR 能力而不自行部署模型的开发者