dsh-auto-vision
在终端中运行以下命令:
dsh plugin install NormanFxxkingRockwell/dsh-auto-vision
将以下提示词粘贴到 DeepSeek Harness 对话框中:
在 DeepSeek Harness 中安装 dsh-auto-vision 插件,请在终端中执行命令 dsh plugin install NormanFxxkingRockwell/dsh-auto-vision。源码地址:https://github.com/NormanFxxkingRockwell/dsh-auto-vision
插件介绍
在 DeepSeek Harness 中,纯文本主模型(如 DeepSeek V4 Flash)天生无法直接读取图片,内置的 read_image 工具会直接被拒绝,导致模型在与图片相关的任务中陷入僵局。dsh-auto-vision 正是为解决这一痛点而生。它充当了一个透明的视觉中间层,能够自动发现你配置的多模态模型,并将图片识别任务委托给它。插件会自动隐藏纯文本会话中失败的 read_image,强制模型走视觉通道,同时支持单图和多图批量识别,以纯文本格式将结果优雅地回流给主模型。无论你是正在构建需要视觉能力的智能体,还是只想让纯文本大模型拥有“看图说话”的能力,这个插件都是完美的补充。
使用场景
- 让纯文本模型也能识别图片内容
- 自动处理多张图片的批量识别任务
- 隐藏失败的读图工具,强制走视觉通道
适合人员
- 使用 DeepSeek V4 Flash 等纯文本模型的开发者
- 需要图片识别能力的智能体用户
- 希望给模型增加视觉能力的 AI 研究者