DSH Plugins
返回列表
🤖

dsh-vision-bridge

模型推理 更新于 2026.08.21

在终端中运行以下命令:

dsh plugin install zzdream67/dsh-vision-bridge

将以下提示词粘贴到 DeepSeek Harness 对话框中:

在具备 Node.js 的终端中运行 dsh plugin install zzdream67/dsh-vision-bridge,即可从 https://github.com/zzdream67/dsh-vision-bridge 安装该插件到 DeepSeek Harness。

插件介绍

在 DeepSeek Harness 中,向纯文本模型粘贴一张截图会被直接拒绝——模型没有视觉能力,对话就此中断。dsh-vision-bridge 让这件事不再成为障碍:你仍然留在当前文本模型里,插件在请求到达模型之前,把每一张图片替换为视觉模型生成的文字转写,模型读到的是词而非像素。无需切换模型、无需注册额外路由,模型选择器里不会出现任何多出来的条目。

插件拦截的是 llm/stream 瀑布流,改写覆盖到任意嵌套深度(包括 tool-result 内部残留的图片块),并内置转写缓存、超时保护、失败通知和 prompt-injection 防护。它会自动在 settings.yaml 中写入 input: [text, image] 声明让主机放行图片,关闭或卸载时又精确撤回,不破坏你手写的其他配置。所有字段均可在浏览器设置页实时编辑,无需重启。

适合在纯文本模型(DeepSeek、本地 Ollama / LM Studio 等)上工作、却经常需要让模型读懂截图、UI 布局、代码日志或表格的开发者。插件本身不附带视觉服务,你需要自备一个可用的视觉模型——本地实例零成本且数据不出机器,远程 API 则按你自己的账户计费。

使用场景

  • 让纯文本模型读取截图中的报错与代码日志
  • 在不调换模型的前提下分析 UI 布局与按钮位置
  • 把图片里的表格与趋势图转成文字再交给文本模型推理

适合人员

  • 在 DeepSeek Harness 中使用纯文本模型的开发者
  • 搭配本地 Ollama 或 LM Studio 视觉模型的个人用户
  • 需要模型读懂图片但不想切换模型的推理使用者