DSH Plugins
返回列表
🤖

dsh-vision

模型推理 更新于 2026.08.25

在终端中运行以下命令:

dsh plugin install yepyeel/dsh-vision

将以下提示词粘贴到 DeepSeek Harness 对话框中:

在 DeepSeek Harness 中,运行命令 dsh plugin install yepyeel/dsh-vision 即可安装插件,源码地址为 https://github.com/yepyeel/dsh-vision。

插件介绍

在使用DeepSeek Harness时,如果你依赖的文本模型(如DeepSeek V4 Flash或Pro)无法直接处理图像附件,那么图像中的信息就无法被模型利用。dsh-vision插件正是为了解决这一痛点而生。它通过在请求发送前自动检测并描述图像内容,将图像块替换为相应的文本描述,从而让文本模型能够间接理解图像信息。整个过程对用户透明:会话日志和用户界面中保留原始图像,仅在模型调用层面进行替换。

该插件的核心能力包括灵活的视觉模型管理:你可以选择自动模式,让插件按优先级尝试已添加的视觉模型,或指定特定模型。如果没有任何可用的视觉模型,插件还能回退到系统OCR功能(支持macOS、Windows和Tesseract),确保图像文本提取不中断。为了提升效率,插件会缓存每个图像的描述结果,避免重复处理。

dsh-vision适合所有使用DeepSeek Harness并希望扩展文本模型图像处理能力的开发者。无论你是想临时处理图像附件,还是需要构建一个多模态工作流,这个插件都能无缝集成,让你无需更换模型即可利用图像数据。

使用场景

  • 当文本模型需要处理图像附件时
  • 在会话中自动描述图像以供模型理解
  • 使用OCR提取图像中的文本信息

适合人员

  • 使用DeepSeek Harness的开发者
  • 需要扩展文本模型图像处理能力的研究人员
  • 处理多模态内容的内容创作者