DSH Plugins
返回列表
🤖

xby-asr-1

模型推理 更新于 2026.09.02

在终端中运行以下命令:

dsh plugin install xby-skill/xby-asr-1

将以下提示词粘贴到 DeepSeek Harness 对话框中:

在终端执行 dsh plugin install xby-skill/xby-asr-1 即可安装该插件,插件源码位于 https://github.com/xby-skill/xby-asr-1 。

插件介绍

在 DeepSeek Harness 对话中,语音转文字往往意味着跳出聊天窗口、打开另一个工具、再手动粘贴结果。xby-asr-1 把这件事拉回了对话本身:你只需要给插件一个音频,文字就出现在当前会话里。它解决的核心问题是——让语音识别成为聊天流中一步完成的操作,而不是需要多工具协作的工作流。

插件基于 Whisper Small 模型,覆盖多国语言及小语种的识别需求。更关键的是输入方式的灵活性:你可以传入音频文件的网络链接,也可以提交 Base64 编码数据,或者直接使用本地文件路径。三种入口对应不同来源的音频资源,免去转换环节的麻烦。API 密钥通过一次设置即可自动持久化,重启后无需重新配置,降低日常使用的心智负担。

如果你需要在对话中频繁处理会议录音、播客素材、多语种语音消息,或者希望把语音内容快速转化为可编辑文本再做后续分析,这个插件是一个轻量且即插即用的选择。它不改变你的工作习惯,只是让语音转写这一步少绕一个弯。

使用场景

  • 在对话中直接转写会议录音或播客片段
  • 处理多语种语音消息并快速提取关键信息
  • 将本地或远程音频一键转为可编辑文本

适合人员

  • 需要在对话流中频繁处理语音内容的开发者
  • 处理多语种语音素材的内容创作者
  • 希望简化语音转写工作流的独立开发者