DSH Plugins
返回列表
deepseek-visual-plugin

deepseek-visual-plugin

工作流 更新于 2026.08.25

在终端中运行以下命令:

dsh plugin install zhangzhimou78-code/deepseek-visual-plugin

将以下提示词粘贴到 DeepSeek Harness 对话框中:

在终端执行 dsh plugin install zhangzhimou78-code/deepseek-visual-plugin 即可安装该插件,完整源码见 https://github.com/zhangzhimou78-code/deepseek-visual-plugin。

插件介绍

DeepSeek 等纯文本模型天然无法"看懂"图片。当用户在 Web UI 中粘贴截图、拖拽图片,或 read_image 等工具返回图片结果时,这些信息对纯文本模型来说就是一堵墙。deepseek-visual-plugin 正是为了解决这个断层:它拦截含图片的消息,调用外部视觉模型将图片翻译为结构化的文字描述,再交给纯文本模型处理;而 GPT-4o、Claude、Qwen-VL 等多模态模型则自动放行,插件不介入。

截图预览

使用场景

  • 在 DeepSeek 对话中粘贴截图,让纯文本模型自动获得图片的文字描述并继续分析
  • read_image 等工具返回图片结果时,插件无缝翻译,纯文本模型无需切换即可理解
  • 多模态与纯文本模型混用时自动识别并放行,无需手动切换配置

适合人员

  • 主要依赖 DeepSeek 等纯文本模型但需要处理图片的开发者
  • 日常工作中频繁做截图分析或 UI 界面理解的用户
  • 同时使用多模态与纯文本模型、希望统一工作流的人