DSH Plugins
返回列表
🤖

dsh-modlens

模型推理 更新于 2026.08.15

在终端中运行以下命令:

dsh plugin install YZz-S/dsh-modlens

将以下提示词粘贴到 DeepSeek Harness 对话框中:

运行 dsh plugin install YZz-S/dsh-modlens 即可安装该插件,源码见 https://github.com/YZz-S/dsh-modlens

插件介绍

纯文本大模型无法直接理解图片,这是搭建多模态工作流时最常见的瓶颈之一。dsh-modlens 将图片转化为包含 OCR、版面分析和语义描述的结构化 JSON 证据,让仅支持文本的模型也能完成看图、读表、识别界面等任务,无需切换到多模态模型。

在核心能力上,该插件支持多视觉引擎并行配置(Gemini、Anthropic、Claude Code、豆包/火山方舟 Ark 等),并允许每次调用通过 provider 参数指定使用哪个引擎;配置了多个引擎时,模型会主动询问用户偏好,省去手动切换的麻烦。

它适合正在用 DeepSeek Harness 搭建 AI 工作流、但主力模型只有文本能力的开发者——只需安装一个插件,即可让现有 Agent 获得看图能力,而不必更换整个模型栈。

使用场景

  • 让纯文本模型识别图表中的数据与趋势
  • 读取 UI 截图并定位元素以驱动自动化操作
  • 将文档照片转为结构化文本供下游分析

适合人员

  • 使用 DeepSeek Harness 且主力模型仅支持文本的开发者
  • 需要给现有 Agent 添加看图能力而不更换模型栈的团队
  • 希望统一管理多个视觉引擎并按需灵活切换的构建者