DSH Plugins
返回列表
🤖

dsh-vision-tools

模型推理 更新于 2026.08.25

在终端中运行以下命令:

dsh plugin install moon09300731/dsh-vision-tools

将以下提示词粘贴到 DeepSeek Harness 对话框中:

在 DeepSeek Harness 中,您可以使用命令 'dsh plugin install moon09300731/dsh-vision-tools' 来安装此插件,插件源码托管在 https://github.com/moon09300731/dsh-vision-tools。

插件介绍

在纯文本大模型主导的对话界面中,DeepSeek 的模型本身不具备视觉能力,这限制了用户在聊天中直接处理图像的需求。dsh-vision-tools 作为 DeepSeek Harness 的视觉全家桶,旨在为纯文本模型无缝添加“眼睛”。它通过注册一个名为 vision_understand 的全局工具,在后台调用兼容 OpenAI 协议的视觉大模型 API(默认使用免费的智谱 GLM-4.6V-Flash),来完成图像描述、文字识别或基于图片的问答。

该插件的核心能力在于其便捷的交互集成与强大的后端弹性。用户可以通过三种方式轻松识图:直接粘贴剪贴板截图(快捷键 Cmd/Ctrl+V)、将图片拖拽到输入框旁的「📷 识图」按钮、或点击该按钮选择本地文件。图片会自动保存并触发识别流程。在后端,它支持包括智谱、阿里百炼、硅基流动和 OpenAI 在内的四家视觉模型供应商切换,并具备智能限流降级机制——当主模型遇到频率限制时,会自动使用备用模型重试,确保识别请求的高可用性。

因此,dsh-vision-tools 特别适合所有希望在 DeepSeek Harness 对话中无缝集成图像理解功能的用户。无论是进行快速截图识别、分析图表内容,还是实现图文交互的 AI 工作流,它都提供了一个低门槛、高灵活度的解决方案。对于开发者和技术使用者而言,它通过配置文件实现的免重启切换和项目级覆盖,也提供了出色的可定制性。

使用场景

  • 快速识别截图或拍照中的文字与内容
  • 在对话中分析图表、示意图或设计稿
  • 实现无需切换应用的图文交互问答

适合人员

  • 需要在使用DeepSeek时处理图像的开发者与技术人员
  • 追求高效图文工作流的AI产品使用者
  • 对免费、多模型切换有需求的本地部署用户