DSH Plugins
返回列表
🧰

dsh-kokoro

联网工具 更新于 2026.09.01

在终端中运行以下命令:

dsh plugin install jwilson411/dsh-kokoro

将以下提示词粘贴到 DeepSeek Harness 对话框中:

在终端执行 dsh plugin install jwilson411/dsh-kokoro 即可安装该插件,完整源码地址为 https://github.com/jwilson411/dsh-kokoro 。

插件介绍

如果你已经在本地跑着 Kokoro TTS 服务器,却苦于 DeepSeek Harness 里的模型只会输出文字、无法直接出声,dsh-kokoro 就是补上这一公里的那个轻量函数插件。它不携带任何模型权重,不需要 API key,运行时零依赖,装完即用。

它向模型注册了唯一的 kokoro_tts 工具:接收 text、voice、speed 三个参数,向本地 Kokoro TTS 服务器的 /tts 端点发一次 POST,把返回的 WAV 写入系统临时目录下的 dsh-kokoro 子目录(目录 0700、文件 0600),再把路径交回给模型。十九个白名单音色、0.5 到 2.0 倍速、30 秒超时、10 MiB 响应上限、RIFF/WAVE 头部校验——全在插件侧完成,坏参数在本地就失败,不会浪费一次网络往返。输出路径由插件固定,调用方无法指定,避免把文本转语音变成任意文件写入。

适合已经在 127.0.0.1 上跑着 kokoro-tts-api、希望让 Harness 里的对话可以直接开口、并且偏好最小攻击面与离线可测试的工程者。它不是音频工具箱:没有播放、没有格式转换、没有混音,只回答一个问题——这段文字听起来像什么——然后给你一个文件路径。

使用场景

  • 让 Harness 模型在对话中直接朗读回复文本为 WAV 音频
  • 将指定文本以白名单音色合成为音频文件并返回保存路径
  • 在无公网 API key 的内网环境中调用本地 Kokoro 服务生成语音

适合人员

  • 已在本地部署 kokoro-tts-api 服务器的开发者
  • 偏好零运行时依赖、最小攻击面的安全敏感用户
  • 离线或内网环境中需要 TTS 能力且不想引入外部 API 的工程师