DSH Plugins
返回列表
dsh-tool-visual-primitives

dsh-tool-visual-primitives

联网工具 更新于 2026.08.24

在终端中运行以下命令:

dsh plugin install InkshadeWoods/dsh-tool-visual-primitives

将以下提示词粘贴到 DeepSeek Harness 对话框中:

在终端执行 dsh plugin install InkshadeWoods/dsh-tool-visual-primitives 完成安装,源码仓库地址为 https://github.com/InkshadeWoods/dsh-tool-visual-primitives ,安装后重启 DeepSeek Harness 并在设置页配置视觉模型即可使用。

插件介绍

DSH 里的纯文本模型无法直接读图,这是很多用户的日常痛点。dsh-tool-visual-primitives 把图片交给外部视觉模型分析,将带有归一化坐标和可引用对象的纯文本证据塞回对话,文本模型无需任何原生图片能力即可获得空间化的图像描述。插件自动识别 11 类视觉任务(描述、计数、空间关系、UI 解析、路径追踪等),配合三档信息密度和可选的视觉原语策略,输出既可供模型推理也可供人核对。会话级缓存让追问时不重复消耗视觉 API 配额,设置页内置密钥安全存储、模型搜索、连接测试和诊断日志。适合已在 DSH Web Profile 中使用纯文本模型、同时拥有任意 OpenAI 兼容视觉接口的开发者,用它完成截图驱动的 UI 复刻、图表解读、多主体定位等多模态任务。

截图预览

使用场景

  • 纯文本模型对话中粘贴截图,自动获得带坐标的结构化图像描述
  • 用截图驱动 UI 复刻,文本模型据视觉证据直接生成对应 HTML 页面
  • 多轮追问同一图片内容时自动复用缓存证据,避免重复消耗视觉 API 配额

适合人员

  • 在 DSH Web Profile 中使用不支持图片输入的纯文本模型的开发者
  • 拥有 OpenAI 兼容视觉接口但缺少端到端多模态对话能力的用户
  • 需要截图驱动 UI 复刻、图表解读或多主体定位的独立开发者