DSH Plugins
返回列表
🤖

dsh-plugin-vision

模型推理 更新于 2026.08.25

在终端中运行以下命令:

dsh plugin install tdf1995/dsh-plugin-vision

将以下提示词粘贴到 DeepSeek Harness 对话框中:

您可以通过运行 'dsh plugin install tdf1995/dsh-plugin-vision' 命令来安装此插件,或从 GitHub 源码地址 https://github.com/tdf1995/dsh-plugin-vision 获取。

插件介绍

在 AI 对话中,许多强大的文本大模型如 DeepSeek 不支持图片输入,这使得图像分析、OCR 和视觉问答等任务变得繁琐,用户不得不切换模型或借助外部工具。dsh-plugin-vision 插件为 DeepSeek Harness 中的纯文本模型无缝添加了视觉能力,通过集成免费的 Gemini 和 GLM 视觉 API,提供了名为 see_image 的工具,允许用户在对话中直接分析本地图片,支持自定义提问、自动图像压缩和双提供商故障转移。此外,它还内置了浏览器端的图片粘贴和拖入功能,让图像处理更加直观便捷。

这个插件特别适合 DSH 用户,包括开发者、研究人员以及任何需要在文本模型对话中处理图像任务的人。无论是快速截图解读、文档 OCR 还是图表分析,它都能以低成本甚至免费的方式实现,无需频繁切换工具或模型,提升了工作效率和交互体验。

使用场景

  • 分析截图中的文本内容
  • 对文档进行 OCR 识别
  • 回答关于图片内容的问题

适合人员

  • 需要处理图像任务的 DSH 用户
  • 开发者在测试视觉功能
  • 研究人员进行多模态实验