dsh-vision-bridge
在终端中运行以下命令:
dsh plugin install DreamRift/dsh-vision-bridge
将以下提示词粘贴到 DeepSeek Harness 对话框中:
在 DeepSeek Harness 终端中执行 dsh plugin install DreamRift/dsh-vision-bridge 即可安装;插件源码详见 https://github.com/DreamRift/dsh-vision-bridge
插件介绍
DeepSeek 官方接口是纯文本的——在 DSH 的 Web UI 里拖入一张截图或设计稿,适配器立刻抛出 UNSUPPORTED_CONTENT,对话就此中断。dsh-vision-bridge 解决的就是这个断层:它在请求链路上拦截含图片的消息,把 ImageBlock 交给 OpenAI 兼容的视觉模型(默认 DashScope qwen-vl-max)生成带逐字 OCR 的结构化中文描述,再以纯文本块的形式放行,让 DeepSeek 拿到它真正能消化的输入。
除了被动代理,插件还注册了 view_image 和 ocr_image 两个主动工具——模型可以按问题去查看本地文件系统中的截图、图表,或单独执行逐字转录。配置端提供设置页「视觉模型」卡片,端点、模型、OCR 参数均可热更新生效,无需重启后端。v0.4.0 起插件还会自动探测当前路由是否原生支持多模态(如 llm-pi-ai),若支持则直接直通、零开销;只有 text-only 路由才走视觉桥代理解析。
适合在 DSH 中使用 DeepSeek 文本模型、又希望对话中无缝引用图片的开发者:调试截图、产品原型、数据图表、代码报错界面——贴进去,模型就能描述和分析。插件零硬 npm 依赖,不修改 DSH 核心源码,Windows / Linux / macOS 即装即用。
使用场景
- 在 DeepSeek 对话中直接贴入截图或设计稿,模型自动描述并分析图中内容
- 让模型主动查看文件系统中的数据图表、代码报错界面或产品原型
- 对图片中的文字进行逐字转录,提取代码、数据或关键信息
适合人员
- 使用 DeepSeek 文本模型进行日常开发对话的工程师
- 需要在对话中频繁引用截图、原型图或图表的产品与设计人员
- 调试时习惯贴入报错截图并希望模型直接解读的后端开发者