DSH Plugins
返回列表
🤖

dsh-compat-probe

模型推理 更新于 2026.09.02

在终端中运行以下命令:

dsh plugin install jwilson411/dsh-compat-probe

将以下提示词粘贴到 DeepSeek Harness 对话框中:

在 DeepSeek Harness 终端中运行 dsh plugin install jwilson411/dsh-compat-probe(源码:https://github.com/jwilson411/dsh-compat-probe)即可完成安装。

插件介绍

当 Harness 指向本地 llama-server 时,第一次真实调用仍可能失败。服务已启动、端点看起来正常,但文档说支持流式、构建版本却把 stream:true 静默吞掉,或者只认 max_tokens 而不认 max_completion_tokens。dsh-compat-probe 向 OpenAI 兼容端点发送五项小型 fixture 请求,返回一张协议卡片,用具体布尔值说明服务端实际支持什么。

卡片覆盖最容易让运行时出错的细节:端点是否可达、GET /models 是否成功、stream:true 是否以 Server-Sent Events 返回、是否被降成单个 JSON 补全,以及服务端是否接受 max_tokens、max_completion_tokens、两者都接受或都不接受。失败也作为字段返回,而不是抛异常,因此连接失败、DNS 失败、超时、HTTP 错误和状态码会落在同一种稳定结构里。

它适合把 DeepSeek Harness 与 dsh-llamacpp 或其他 OpenAI 兼容服务搭配使用的运营者和开发者。它不下载权重、不启动进程、不做 GPU 基准测试或压力测试,也不说 Ollama API。默认只允许环回地址,除非在 profile 中显式允许,才允许探测远程主机,因此适合在模型代理调用前做一次安静的本地兼容性检查。

使用场景

  • 部署 Harness 前快速验证本地 llama-server 的 OpenAI 兼容行为
  • 排查 stream 被静默忽略或 token 参数不被识别等运行时故障
  • 为 dsh-llamacpp 配对服务生成一份可审计的协议能力报告

适合人员

  • 将 DeepSeek Harness 与 llama.cpp 本地服务搭配使用的运营者
  • 负责模型代理运行时稳定性排查的开发者
  • 需要在生产前验证 OpenAI 兼容服务端实际行为的平台团队