DSH Plugins
返回列表
dsh-llm-openai-completions

dsh-llm-openai-completions

模型推理 更新于 2026.08.31

在终端中运行以下命令:

dsh plugin install drscrewdriver/dsh-llm-openai-completions

将以下提示词粘贴到 DeepSeek Harness 对话框中:

在 DeepSeek Harness 终端中执行 dsh plugin install drscrewdriver/dsh-llm-openai-completions 即可安装该插件,完整源码地址为 https://github.com/drscrewdriver/dsh-llm-openai-completions 。

插件介绍

DeepSeek Harness 默认的 pi-ai 兼容层对非标准 baseURL 一律假设网关支持 developer 角色,结果 vLLM、LM Studio 等自托管代理一收到 developer 就抛 400;Qwen3 系列模型又把思考文本直接塞进 content 正文,前端无法分离 reasoning 块。dsh-llm-openai-completions 作为第四类适配器,以零猜测策略接管这些 provider 的 wire 行为:system 永远以 role:"system" 下发,thinking 字段严格按模型的 compat.thinkingFormat 透传——Qwen 走 enable_thinking、chat-template 走 chat_template_kwargs、effort 类走 reasoning_effort,接收侧再把混入 content 的思考文本拆回独立的 reasoning block,彻底消除角色 400 和正文污染。

v0.2.0 起该适配器同时打通视觉输入链路:当模型在 llm-pi-ai 配置中声明了 image 输入能力,用户上传的单张或多张图片会以 base64 data URI 形式序列化为 OpenAI 兼容的 multi-part content 数组,顺序与文本片段保持源序;未声明视觉能力的模型则明确以 UNSUPPORTED_CONTENT 拒绝,不静默丢弃任何数据。

所有配置仍写在 Settings → Models 的 llm-pi-ai 段,插件不会重新注册路由,而是 wrap 已有 provider 的流,因此与 llm-deepseek、llm-pi-ai 两类内置适配器互不冲突。它适合在日常开发中依赖 vLLM、LM Studio 或自建 OpenAI 代理跑 Qwen 等自托管模型、需要正确 thinking 透传与多图片视觉输入、又不想改动 pi-ai 源码的团队和个人。

截图预览

使用场景

  • 在 vLLM 或 LM Studio 后端运行 Qwen 模型时避免 developer 角色 400 报错
  • 自托管 OpenAI 代理按 compat.thinkingFormat 正确透传 enable_thinking 或 reasoning_effort
  • 视觉模型接收单张或多张图片并保持源序,非视觉模型以 UNSUPPORTED_CONTENT 明确拒绝

适合人员

  • 依赖 vLLM、LM Studio 等自托管推理网关跑 Qwen 等开源模型的开发者
  • 需要正确分离 reasoning 块与正文内容的 LLM 应用团队
  • 偏好插件化适配、不想 fork pi-ai 源码的 DeepSeek Harness 用户