dsh-tool-vision-read
在终端中运行以下命令:
dsh plugin install Mappedinfo/dsh-tool-vision-read
将以下提示词粘贴到 DeepSeek Harness 对话框中:
在 DeepSeek Harness 中安装此插件,请运行 dsh plugin install Mappedinfo/dsh-tool-vision-read 命令,该命令将使用源代码仓库 https://github.com/Mappedinfo/dsh-tool-vision-read 中的配置。
插件介绍
在 AI 系统中,纯文本模型往往受限于无法直接“看”图,导致处理视觉内容时举步维艰。dsh-tool-vision-read 正是为了解决这一痛点而生的轻量级插件。它的核心能力在于将复杂的图像描述任务无缝委托给专用的视觉模型路由。通过支持“直接模式”和“子代理模式”,它既能提供即时的文本描述,又能灵活处理复杂的图像分析流程,无需手动转发或依赖第三方 CLI 工具。这款插件非常适合那些拥有视觉能力模型路由,但希望保持文本模型简洁性的开发者或团队。它让文本代理能够像拥有眼睛一样“看”到世界,极大地扩展了现有工作流的边界,同时保持了极低的配置成本。
截图预览
使用场景
- 纯文本模型需要读取并分析上传的图片内容。
- 自动化工作流中处理包含视觉信息的文档或截图。
- 实现文档截图的自动 OCR 或视觉问答。
适合人员
- 调用该工具的 DeepSeek Harness 开发者。
- 需要为不同模型分配不同路由的 AI 架构师。
- 想要纯文本模型具备视觉能力的 AI 研究人员。