dsh-image-subagent
在终端中运行以下命令:
dsh plugin install yuqingsh/dsh-image-subagent
将以下提示词粘贴到 DeepSeek Harness 对话框中:
在 DeepSeek Harness 中,运行命令 dsh plugin install yuqingsh/dsh-image-subagent 从 https://github.com/yuqingsh/dsh-image-subagent 安装该插件。
插件介绍
纯文本主模型(如 DeepSeek-v4-Pro)在处理图像附件时面临挑战,因为它们无法直接解析图像数据,限制了在多模态任务中的应用。dsh-image-subagent 插件旨在解决这一问题,提供无缝集成方案。
该插件的核心能力在于将图像转换为文本占位符。当用户贴图时,图像被投影为带有完整 attachmentId 的显式占位符,主模型据此识别图像存在,并委托给预设的视觉子代理(如 DeepSeek-v4-Flash-Vision-Exp)使用 read_image 工具读取图像路径,获取详细描述。这种委托机制确保了主模型无需具备多模态能力即可间接处理图像。
此插件特别适合开发者、研究人员和任何使用纯文本主模型但需要处理图像数据的用户。它适用于构建智能助手、图像分析工具或扩展模型功能的场景,允许用户在保持主模型纯文本特性的同时,轻松集成图像处理能力。
使用场景
- 用户上传图片并提问,主模型委托子代理读取图像内容。
- 开发纯文本模型应用时集成图像处理能力。
- 研究视觉子代理与文本模型协同工作。
适合人员
- 开发者需要扩展纯文本模型的多模态能力。
- 研究人员探索图像与文本模型的交互。
- AI爱好者尝试构建图像处理应用。