DSH Plugins
返回列表
🤖

dsh-vision-plugin

模型推理 更新于 2026.08.20

在终端中运行以下命令:

dsh plugin install Xin-Zhang-IceMan/dsh-vision-plugin

将以下提示词粘贴到 DeepSeek Harness 对话框中:

在 DeepSeek Harness 终端中执行 dsh plugin install Xin-Zhang-IceMan/dsh-vision-plugin 即可安装,插件源码见 https://github.com/Xin-Zhang-IceMan/dsh-vision-plugin 。

插件介绍

DeepSeek Harness 的 deepseek-v4 系列是纯文本模型:往聊天框里丢一张截图或表格照片,模型完全看不见。dsh-vision-plugin 正是为填补这个空白而生——它会拦截即将进入纯文本会话的图片,先送给一个视觉模型转写成文字,再把描述交还给主模型作答,体验上和原生视觉几乎没有区别。

插件提供三层能力。最轻的一层是零门槛路径:直接把图片粘贴或拖入聊天,只要该模型已声明图片能力,它就能立刻回答,无需任何特殊指令。中间一层是 vision_analyze 工具,模型可以自主调用它来分析本地图片文件,支持附加提问和指定视觉模型。最外面一层是 DSH 设置面板里的 Vision Model 页面,可以选择默认视觉模型、查看当前路由,选择会持久保存并在重启后自动恢复。底层还有按图片和问题维度的缓存、两分钟超时熔断、失败自动重试等机制,确保对话永远不会因视觉调用而中断。

这个插件适合在 DeepSeek Harness 中以纯文本模型为主、但经常需要看懂截图、表格、图表的用户。只要在 provider 配置中有一个可用的视觉模型,安装后即可让所有已声明图片能力的文本模型无缝读取图片,不必为此切换主模型。

使用场景

  • 粘贴截图或表格图片,纯文本模型自动读取并作答
  • 模型通过 vision_analyze 工具主动分析本地图片文件并附带提问
  • 在 DSH 设置页选择默认视觉模型并查看当前路由

适合人员

  • 以纯文本模型为主、经常需要看懂截图或表格的 DSH 用户
  • 不想为读图而切换主模型的开发者
  • 在 provider 中已配置视觉模型、希望所有文本模型都能读图的团队