deepseek-visual-plugin
在终端中运行以下命令:
dsh plugin install zhangzhimou78-code/deepseek-visual-plugin
将以下提示词粘贴到 DeepSeek Harness 对话框中:
在终端执行 dsh plugin install zhangzhimou78-code/deepseek-visual-plugin 即可安装该插件,完整源码见 https://github.com/zhangzhimou78-code/deepseek-visual-plugin。
插件介绍
DeepSeek 等纯文本模型天然无法"看懂"图片。当用户在 Web UI 中粘贴截图、拖拽图片,或 read_image 等工具返回图片结果时,这些信息对纯文本模型来说就是一堵墙。deepseek-visual-plugin 正是为了解决这个断层:它拦截含图片的消息,调用外部视觉模型将图片翻译为结构化的文字描述,再交给纯文本模型处理;而 GPT-4o、Claude、Qwen-VL 等多模态模型则自动放行,插件不介入。
截图预览
使用场景
- 在 DeepSeek 对话中粘贴截图,让纯文本模型自动获得图片的文字描述并继续分析
- read_image 等工具返回图片结果时,插件无缝翻译,纯文本模型无需切换即可理解
- 多模态与纯文本模型混用时自动识别并放行,无需手动切换配置
适合人员
- 主要依赖 DeepSeek 等纯文本模型但需要处理图片的开发者
- 日常工作中频繁做截图分析或 UI 界面理解的用户
- 同时使用多模态与纯文本模型、希望统一工作流的人



