dsh-vision
在终端中运行以下命令:
dsh plugin install zoahdev/dsh-vision
将以下提示词粘贴到 DeepSeek Harness 对话框中:
在 DeepSeek Harness 中执行 dsh plugin install zoahdev/dsh-vision 即可安装,源码见 https://github.com/zoahdev/dsh-vision。
插件介绍
DeepSeek Harness 原生链路只处理纯文本,一旦对话中需要分析截图、产品照片或数据图表,模型便无从下手。dsh-vision 正是为这个缺口而生,它给 Harness 装上视觉能力,让推理流程可以直接理解图像内容。
接入后,开发者只需调用 vision_analyze 工具,传入本地图片路径或 https/data: URL,再附带一句问题(默认为请详细描述这张图),插件便会将请求发送至任意 OpenAI 兼容的视觉模型端点,返回结构化的文字回答。apiKey、baseUrl、model、timeoutMs 均可在项目配置中调整,因此既能对接云端 OpenAI,也能指向本地 Ollama 等私有部署,无需改动 Harness 核心代码。
它适合在 Agent 工作流中需要实时理解图像的场景:文档截图问答、电商商品图描述、仪表盘数据解读等。社区轻量插件,MIT 协议,零运行时依赖,即装即用。
使用场景
- 对话中需要分析截图、产品照片或图表内容
- Agent 工作流中实时解读仪表盘数据并给出文字洞察
- 本地部署 Ollama 加 llava 实现私有化图像描述,不依赖云端
适合人员
- 需要为 DeepSeek Harness 接入视觉能力的开发者
- 偏好本地部署、不希望图像数据离开内网的团队
- 构建多模态 Agent 工作流的工程师