dsh-tool-visual-primitives
在终端中运行以下命令:
dsh plugin install InkshadeWoods/dsh-tool-visual-primitives
将以下提示词粘贴到 DeepSeek Harness 对话框中:
在终端执行 dsh plugin install InkshadeWoods/dsh-tool-visual-primitives 完成安装,源码仓库地址为 https://github.com/InkshadeWoods/dsh-tool-visual-primitives ,安装后重启 DeepSeek Harness 并在设置页配置视觉模型即可使用。
插件介绍
DSH 里的纯文本模型无法直接读图,这是很多用户的日常痛点。dsh-tool-visual-primitives 把图片交给外部视觉模型分析,将带有归一化坐标和可引用对象的纯文本证据塞回对话,文本模型无需任何原生图片能力即可获得空间化的图像描述。插件自动识别 11 类视觉任务(描述、计数、空间关系、UI 解析、路径追踪等),配合三档信息密度和可选的视觉原语策略,输出既可供模型推理也可供人核对。会话级缓存让追问时不重复消耗视觉 API 配额,设置页内置密钥安全存储、模型搜索、连接测试和诊断日志。适合已在 DSH Web Profile 中使用纯文本模型、同时拥有任意 OpenAI 兼容视觉接口的开发者,用它完成截图驱动的 UI 复刻、图表解读、多主体定位等多模态任务。
截图预览
使用场景
- 纯文本模型对话中粘贴截图,自动获得带坐标的结构化图像描述
- 用截图驱动 UI 复刻,文本模型据视觉证据直接生成对应 HTML 页面
- 多轮追问同一图片内容时自动复用缓存证据,避免重复消耗视觉 API 配额
适合人员
- 在 DSH Web Profile 中使用不支持图片输入的纯文本模型的开发者
- 拥有 OpenAI 兼容视觉接口但缺少端到端多模态对话能力的用户
- 需要截图驱动 UI 复刻、图表解读或多主体定位的独立开发者

