dsh-vision-helper
在终端中运行以下命令:
dsh plugin install Yuuz12/dsh-vision-helper
将以下提示词粘贴到 DeepSeek Harness 对话框中:
在终端执行 dsh plugin install Yuuz12/dsh-vision-helper 即可从 npm 安装,也可从 https://github.com/Yuuz12/dsh-vision-helper 拉取源代码手动安装,两种方式均零依赖、无需构建。
插件介绍
DeepSeek Harness 的智能体以纯文本为核心驱动,但实际使用中,报错截图、UI 线框图、数据图表等图片任务十分常见。纯文本模型无法看图,用户被迫手动转述,智能体也只能凭描述猜测——这正是 dsh-vision-helper 要解决的痛点。
插件向宿主注册一个 vision_analyze 工具:接受本地图片路径或 data URI,将图片发送给用户自行配置的多模态模型(任意 OpenAI 兼容视觉端点),返回结构化分析文字。整个包采用零依赖设计,没有构建步骤、没有软链接、没有 npm install,安装后即为全局持久的会话级工具。同时,插件会向系统提示注入智能引导——在 auto 模式下,若主模型本身已能看图则直接查看、零额外开销;仅当主模型为纯文本时才自动调用 vision_analyze,无需用户手动触发。
如果你的日常工作流中经常需要智能体独立读懂一张截图或图表,或者你已经配好了多模态路由、希望让专用视觉模型承担识别任务而非让主模型硬猜,这个插件就是为此设计的。所有配置即时生效,重启不丢失,适合追求轻量、无额外维护成本的 DSH 用户。
使用场景
- 智能体需要读取用户粘贴的报错截图并给出修复建议
- 用户上传 UI 设计稿或流程图,期望智能体直接描述其结构
- 智能体需从数据图表中提取数值并生成文字报告
适合人员
- 希望智能体独立处理图片任务的 DSH 日常使用者
- 已配置多模态模型路由、想让专用视觉模型分担识别工作的开发者
- 偏好零依赖、即装即用、无需构建步骤的轻量插件用户