dsh-vision-bridge
在终端中运行以下命令:
dsh plugin install sfyyy/dsh-vision-bridge
将以下提示词粘贴到 DeepSeek Harness 对话框中:
在 DeepSeek Harness 中,通过命令 dsh plugin install sfyyy/dsh-vision-bridge 安装此插件,完整源码地址为 https://github.com/sfyyy/dsh-vision-bridge。
插件介绍
文本-only 的 DeepSeek 会话在处理图像分析时面临一个尴尬困境:传统多模态方案需要将整个对话历史连同图像一起发送,导致上下文膨胀和成本激增。dsh-vision-bridge 插件精准解决了这一痛点,它为会话注入按需视觉能力——当文本模型判断需要查看截图、图表或上传的图片时,会自动调用 vision_describe 工具。
该插件的核心在于精巧的“最小化触达”设计:它通过钩子拦截会话中的图像附件,但只在必要时将图像和针对性问题发送到 OpenAI 兼容的视觉模型,完全绕过动辄数十万 token 的对话历史。这意味着成本始终可控,同时会话日志和用户界面完整保留原始图像,交互体验毫无折损。用户还可以自由配置自己的视觉端点,无论是云服务还是本地模型,都能无缝对接。
这款插件尤其适合两类人群:一是依赖 DeepSeek Harness 进行高效文本工作,却时常需要临时分析文档图像、UI 截图或数据图表的开发者和知识工作者;二是希望以最低成本扩展 AI 多模态能力的团队,他们不必为偶尔的图像需求切换整个模型生态。它让文本会话在保持轻量高效的同时,拥有了随时洞察视觉信息的能力。
截图预览
使用场景
- 分析上传的图表和示意图以提取关键信息
- 解读屏幕截图中的文本内容进行自动化处理
- 比较多张图像的差异用于质量检查或数据比对
适合人员
- 使用 DeepSeek Harness 进行文本交互的开发者
- 偶尔需要分析图像以辅助决策的知识工作者
- 希望以最小成本扩展 AI 多模态能力的团队