DSH Plugins
返回列表
🤖

dsh-auto-vision

模型推理 更新于 2026.08.25

在终端中运行以下命令:

dsh plugin install NormanFxxkingRockwell/dsh-auto-vision

将以下提示词粘贴到 DeepSeek Harness 对话框中:

在 DeepSeek Harness 中安装 dsh-auto-vision 插件,请在终端中执行命令 dsh plugin install NormanFxxkingRockwell/dsh-auto-vision。源码地址:https://github.com/NormanFxxkingRockwell/dsh-auto-vision

插件介绍

在 DeepSeek Harness 中,纯文本主模型(如 DeepSeek V4 Flash)天生无法直接读取图片,内置的 read_image 工具会直接被拒绝,导致模型在与图片相关的任务中陷入僵局。dsh-auto-vision 正是为解决这一痛点而生。它充当了一个透明的视觉中间层,能够自动发现你配置的多模态模型,并将图片识别任务委托给它。插件会自动隐藏纯文本会话中失败的 read_image,强制模型走视觉通道,同时支持单图和多图批量识别,以纯文本格式将结果优雅地回流给主模型。无论你是正在构建需要视觉能力的智能体,还是只想让纯文本大模型拥有“看图说话”的能力,这个插件都是完美的补充。

使用场景

  • 让纯文本模型也能识别图片内容
  • 自动处理多张图片的批量识别任务
  • 隐藏失败的读图工具,强制走视觉通道

适合人员

  • 使用 DeepSeek V4 Flash 等纯文本模型的开发者
  • 需要图片识别能力的智能体用户
  • 希望给模型增加视觉能力的 AI 研究者