dsh-vision-bridge
在终端中运行以下命令:
dsh plugin install zzdream67/dsh-vision-bridge
将以下提示词粘贴到 DeepSeek Harness 对话框中:
在具备 Node.js 的终端中运行 dsh plugin install zzdream67/dsh-vision-bridge,即可从 https://github.com/zzdream67/dsh-vision-bridge 安装该插件到 DeepSeek Harness。
插件介绍
在 DeepSeek Harness 中,向纯文本模型粘贴一张截图会被直接拒绝——模型没有视觉能力,对话就此中断。dsh-vision-bridge 让这件事不再成为障碍:你仍然留在当前文本模型里,插件在请求到达模型之前,把每一张图片替换为视觉模型生成的文字转写,模型读到的是词而非像素。无需切换模型、无需注册额外路由,模型选择器里不会出现任何多出来的条目。
插件拦截的是 llm/stream 瀑布流,改写覆盖到任意嵌套深度(包括 tool-result 内部残留的图片块),并内置转写缓存、超时保护、失败通知和 prompt-injection 防护。它会自动在 settings.yaml 中写入 input: [text, image] 声明让主机放行图片,关闭或卸载时又精确撤回,不破坏你手写的其他配置。所有字段均可在浏览器设置页实时编辑,无需重启。
适合在纯文本模型(DeepSeek、本地 Ollama / LM Studio 等)上工作、却经常需要让模型读懂截图、UI 布局、代码日志或表格的开发者。插件本身不附带视觉服务,你需要自备一个可用的视觉模型——本地实例零成本且数据不出机器,远程 API 则按你自己的账户计费。
使用场景
- 让纯文本模型读取截图中的报错与代码日志
- 在不调换模型的前提下分析 UI 布局与按钮位置
- 把图片里的表格与趋势图转成文字再交给文本模型推理
适合人员
- 在 DeepSeek Harness 中使用纯文本模型的开发者
- 搭配本地 Ollama 或 LM Studio 视觉模型的个人用户
- 需要模型读懂图片但不想切换模型的推理使用者