DSH Plugins
返回列表
🖥️

dsh-subagent-vision

客户端 更新于 2026.08.25

在终端中运行以下命令:

dsh plugin install niuniuaba/dsh-subagent-vision

将以下提示词粘贴到 DeepSeek Harness 对话框中:

在 DeepSeek Harness 终端中执行 dsh plugin install niuniuaba/dsh-subagent-vision 即可安装,完整源码仓库地址为 https://github.com/niuniuaba/dsh-subagent-vision

插件介绍

DeepSeek 的对话模型本身不接受图片输入,harness 也会拒绝把含图片的会话切到纯文本模型——于是你想在纯文本 DeepSeek 会话里处理一张截图时,要么换模型、要么开新会话、要么手动复制文字,体验都很割裂。dsh-subagent-vision 把这件事变成一件自然的事:你像平时一样把图片粘贴或拖进输入框,发送瞬间浏览器端自动将每张图片写入一个私有临时文件,把文件路径追加到你的提示词里,请求全程只携带文本,不再触发图片准入拦截。主代理看到路径后调用 subagent_vision 工具,将读取任务委托给一个路由到你指定视觉模型的子代理;子代理用自己的 read_image 工具完成识图,只把文字结论返回主会话——主模型始终不接触图片本体,当前会话的模型也始终是纯文本,不需要切换。视觉模型在「设置 > 视觉处理模型」下拉框里选,默认 qwen3.8-max,也可以指定任意声明了图片输入的模型,选择会持久化到 settings.yaml 和 bundle 的 patch 文件中,重启后依然生效。接收端体验完全保持原生:缩略图轨道、删除、撤销都不受影响,插件只在发送那一刻做路径转换。适合日常以 DeepSeek 纯文本模型为主、偶尔需要让 Agent 读图(截图、图表、手写笔记、UI 设计稿)的用户:你不需要记住「先换模型再粘图」,也不需要把图片丢到另一个窗口,粘贴、描述需求、继续对话,一次完成。

使用场景

  • 在纯文本 DeepSeek 会话中直接粘贴截图,让 Agent 读取并继续对话
  • 将图表或 UI 设计稿拖入输入框,无需切换模型即可获取文字描述
  • 对话中提供图片路径或 URL,由视觉子代理完成识图并返回结论

适合人员

  • 以纯文本 DeepSeek 为主、偶尔需要 Agent 读图的日常用户
  • 不愿为一张截图开新会话或手动切换模型的效率优先用户
  • 在 harness 环境中定制多模型协作流程的插件开发者