dsh-vision
在终端中运行以下命令:
dsh plugin install yepyeel/dsh-vision
将以下提示词粘贴到 DeepSeek Harness 对话框中:
在 DeepSeek Harness 中,运行命令 dsh plugin install yepyeel/dsh-vision 即可安装插件,源码地址为 https://github.com/yepyeel/dsh-vision。
插件介绍
在使用DeepSeek Harness时,如果你依赖的文本模型(如DeepSeek V4 Flash或Pro)无法直接处理图像附件,那么图像中的信息就无法被模型利用。dsh-vision插件正是为了解决这一痛点而生。它通过在请求发送前自动检测并描述图像内容,将图像块替换为相应的文本描述,从而让文本模型能够间接理解图像信息。整个过程对用户透明:会话日志和用户界面中保留原始图像,仅在模型调用层面进行替换。
该插件的核心能力包括灵活的视觉模型管理:你可以选择自动模式,让插件按优先级尝试已添加的视觉模型,或指定特定模型。如果没有任何可用的视觉模型,插件还能回退到系统OCR功能(支持macOS、Windows和Tesseract),确保图像文本提取不中断。为了提升效率,插件会缓存每个图像的描述结果,避免重复处理。
dsh-vision适合所有使用DeepSeek Harness并希望扩展文本模型图像处理能力的开发者。无论你是想临时处理图像附件,还是需要构建一个多模态工作流,这个插件都能无缝集成,让你无需更换模型即可利用图像数据。
使用场景
- 当文本模型需要处理图像附件时
- 在会话中自动描述图像以供模型理解
- 使用OCR提取图像中的文本信息
适合人员
- 使用DeepSeek Harness的开发者
- 需要扩展文本模型图像处理能力的研究人员
- 处理多模态内容的内容创作者