dsh-image-vision-bridge
在终端中运行以下命令:
dsh plugin install Icestab/dsh-image-vision-bridge
将以下提示词粘贴到 DeepSeek Harness 对话框中:
请在 DeepSeek Harness 中执行安装命令以安装 dsh-image-vision-bridge 插件,访问 https://github.com/Icestab/dsh-image-vision-bridge 获取源码。
插件介绍
DeepSeek Harness 环境下,主模型直接处理图片块往往会导致兼容性问题,影响对话流畅度。dsh-image-vision-bridge 正是为解决这一多模态交互障碍而生。它作为宿主插件,巧妙地介入 LLM 流水线,在不修改原始会话日志的前提下,将用户发送的图片瞬间转换为视觉模型的文本描述,再交由主模型理解。
其核心能力在于“隐形桥接”:图片依然保留在聊天记录中供查看,但系统内部会自动调用视觉模型(默认为 mimo-v2.5)生成摘要,并将其注入主模型请求,完全屏蔽了冗余的解析文本。这种设计不仅保证了对话的纯净度,还通过进程内缓存和降级策略,确保了极高的稳定性和容错性。
这款插件特别适合希望利用 DeepSeek 强大的逻辑能力处理视觉信息的开发者,无论是图像分析、场景理解还是多轮视觉问答。如果你厌倦了在对话中看到“图片解析”等中间过程,或者希望在不修改代码的情况下为现有的 DeepSeek 实例开启视觉能力,那么 dsh-image-vision-bridge 是你最佳的选择。
使用场景
- 自动识别并分析上传的图片内容。
- 在对话中询问图片细节并获得解答。
- 隐藏图片解析过程,保持聊天界面整洁。
适合人员
- 使用 DeepSeek Harness 的开发者。
- 需要处理图片信息但不希望看到解析文本的用户。
- 希望增强大模型视觉能力的 AI 爱好者。