DSH Plugins
返回列表
🤖

dsh-analyze-image-tool

模型推理 更新于 2026.08.25

在终端中运行以下命令:

dsh plugin install CaseyTso/dsh-analyze-image-tool

将以下提示词粘贴到 DeepSeek Harness 对话框中:

在终端执行 dsh plugin install CaseyTso/dsh-analyze-image-tool 即可安装,项目源码地址为 https://github.com/CaseyTso/dsh-analyze-image-tool

插件介绍

DeepSeek Harness 中大量常用模型(如 deepseek-v4-flash)是纯文本架构,无法原生接收图像。更棘手的是,DSH 的 API 网关在所有插件钩子执行之前就会拦截「图像 + 纯文本模型」的请求并直接报错,视觉能力在基础设施层被彻底切断。

dsh-analyze-image-tool 的思路是在文本模型会话中架起一座视觉之桥。它注册一个 analyze_image 工具,任何模型都可以调用;插件随后将图像以 base64 方式转发到你指定的任意 OpenAI 兼容视觉端点,并以结构化格式(正文、模型 ID、token 计数)将结果返回给模型。代码中不绑定任何厂商——一组 baseURL + apiKey + model 即可适配 SiliconFlow、阿里 DashScope 兼容模式、智谱、OpenRouter、本地 Ollama 或 OpenAI 等。对于粘贴图像的场景,插件内置了运行时桥接:当当前模型不支持图像时,自动将图像块改写为可读的附件引用,引导模型主动调用 analyze_image 来「看见」图片;视觉模型则原样透传不受影响。WebUI 会话头部的小眼睛图标提供完整设置面板,可编辑端点、密钥、提示词模板,保存多组预设,并一键测试连通性,改动即时生效无需重启。

适合谁用?运行纯文本 DSH 模型、又经常需要让模型读取截图、图表或拍照文档的用户。无需切换模型、无需额外代理、无需绑定特定厂商。安装插件后,指向任何你已有的视觉端点,往对话框里粘贴图片即可直接工作。

使用场景

  • 纯文本模型会话中粘贴截图,让模型读取图表并回答图片相关问题
  • 通过 WebUI 面板在 SiliconFlow、DashScope、本地 Ollama 等不同视觉端点间一键切换
  • 本地 Ollama 离线场景下使用 Qwen3-VL 批量分析本地文档或手写笔记图片

适合人员

  • 使用纯文本 DSH 模型又需要图像理解能力的开发者
  • 希望不绑定特定厂商、自由选择视觉端点的用户
  • 需要在本地离线环境中跑视觉分析、不想把图片传到云端的团队