dsh-vision-assist
在终端中运行以下命令:
dsh plugin install wjling/dsh-vision-assist
将以下提示词粘贴到 DeepSeek Harness 对话框中:
在 DeepSeek Harness 终端执行 dsh plugin install wjling/dsh-vision-assist 即可安装,源码见 https://github.com/wjling/dsh-vision-assist 。
插件介绍
当 DeepSeek Harness 中的主模型是纯文本模型时,粘贴一张图片立刻触发"does not support image input"拒绝,对话被迫中断。dsh-vision-assist 在 LLM 调用边界拦截请求,将图片块改写为附件路径加 vision_recognize 文字指引,把真正的图像识别交给你在设置中选定的多模态模型。聊天气泡与会话历史始终保留原图,降级对用户完全透明。
插件注册了宿主级 vision_recognize 工具,支持 coarse / default / fine 三档精细度,可附加自定义 prompt。识别模型可在 DSH 设置页的视觉助手卡片或配置文件中即时切换,无需重启。路由到具备视觉能力的模型时,插件不做任何干预,请求原样通过。
适合主模型为纯文本但仍需在对话中途粘贴图片获取视觉信息的 DSH 用户,尤其是需要在多个模型之间灵活路由、不想为了看一张图就切换整个会话场景的人。
使用场景
- 纯文本对话中粘贴图片并获取识别结果
- 多模型路由时避免图片输入被拒绝
- 无需切换会话即可为文本模型补充视觉能力
适合人员
- 主模型为纯文本的 DSH 用户
- 需要在对话中途使用图片的开发者
- 多模型路由场景下需要灵活视觉能力的用户