dsh-vision-bridge
在终端中运行以下命令:
dsh plugin install 342949145/dsh-vision-bridge
将以下提示词粘贴到 DeepSeek Harness 对话框中:
在 DeepSeek Harness 中执行 dsh plugin install 342949145/dsh-vision-bridge 即可安装,项目源码地址:https://github.com/342949145/dsh-vision-bridge
插件介绍
在 DSH 网页版会话中使用 DeepSeek 等纯文本模型时,发送带图片的消息会被直接拒绝,read_image 工具同样被能力检查拦截。DSH 将这些模型的输入模态声明为仅文本,导致图片功能完全不可用。dsh-vision-bridge 让这一切变得透明:你照常拖入图片、调用工具,插件在底层自动完成识图转文字,无需切换模型,无需手动运行任何命令。
插件从两个层面工作。放行层:包装 resolveModelInfo,为目标 provider 的模型补充 image 输入能力声明,使所有模型能力检查顺利通过。转译层:包装 provider 适配器的 stream 方法,在消息序列化之前将 image 块逐个取出,调用阿里云百炼视觉 API 完成识图,再将结果替换为纯文本块——模型最终收到的始终是文字,会话记录与 GUI 保持原样不变。默认主模型为 qwen-vl-max,失败时自动回退至 qwen-vl-plus 及 flash 系列,认证与参数错误不盲目重试。
除自动识图外,插件还支持文生图(对模型说 画一张… 即可调用百炼 Qwen-Image 生成图片并保存为附件)、识别结果缓存(同图不重复调用 API,内存加落盘跨会话复用)、以及 URL 识图、OCR 提示、多图对比等扩展能力。配置灵活,支持环境变量、插件 .env、设置页、claude-vision-skill 目录等多种来源,优先级清晰。
适合在 DSH 网页版中使用 DeepSeek 系列纯文本模型、又希望保留图片交互体验的开发者与日常用户。纯服务端插件,GUI 无任何改动,与桌面版内置 dsh-tool-vision 互不冲突(需关闭 bridgeTextOnly),开箱即用。
使用场景
- 在 DSH 网页版用 DeepSeek 模型发消息时附带截图,让模型自动分析图片内容
- 调用 read_image 工具读取本地文档截图后,无需切换模型即可获取文字描述
- 让模型描述报错截图、设计稿、网页布局等图片,并以纯文本回传给下游处理
适合人员
- 使用 DeepSeek 等纯文本模型的 DSH 网页版日常用户
- 希望在不更换模型的前提下获得图片理解能力的开发者
- 频繁向 AI 助手发送截图并期待文字分析的办公与研发人员