DSH Plugins
返回列表
dsh-vision

dsh-vision

联网工具 更新于 2026.08.15

在终端中运行以下命令:

dsh plugin install sjakdhasdh/dsh-vision

将以下提示词粘贴到 DeepSeek Harness 对话框中:

在 DeepSeek Harness 终端中执行 dsh plugin install sjakdhasdh/dsh-vision 即可安装该识图插件(源码地址:https://github.com/sjakdhasdh/dsh-vision)。

插件介绍

DeepSeek Harness 里不少模型(比如 deepseek-v4-flash)天生不会看图,而默认的 DeepSeek adapter 干脆把图片上传拦下来,报错 MODEL_DOES_NOT_SUPPORT_IMAGES,用户连试的机会都没有。dsh-vision 正是为这个缺口而生:它给纯文本模型装上一双眼睛,让对话过程中可以随时识别一张本地或网络图片,并以中文描述写回上下文。

使用流程很简单。推理过程中模型会自动调用一个 vision 工具,把本地绝对路径或 http(s) 链接交给一个视觉大模型(默认走阿里云百炼 qwen3.7-flash,基于 OpenAI 兼容接口,换厂商只需改一行 base URL),拿回一段文字描述后继续推理。整个插件零额外运行时依赖,只用 Node 内置的 fetch;配置优先级为插件 config、环境变量、默认值,干净利落。

适合两类人:在 DeepSeek Harness 上搭建智能体、需要给纯文本模型补充视觉能力的开发者,以及日常想在聊天框里直接粘贴一张截图、立刻拿到中文描述的用户。配合项目 PATCHES.md 里那个小补丁解除上传拦截后,粘贴图片即得描述的闭环可以直接跑起来。

截图预览

使用场景

  • 聊天中粘贴截图,让纯文本模型自动描述图片内容
  • 智能体推理时调用视觉大模型识别本地或网络图片
  • 为没有原生识图能力的 DeepSeek 模型补充视觉能力

适合人员

  • 在 DeepSeek Harness 上搭建智能体的开发者
  • 需要让纯文本模型具备看图能力的用户
  • 想快速给 Harness 补齐视觉工具链的技术人员