modlens
在终端中运行以下命令:
dsh plugin install liustack/modlens
将以下提示词粘贴到 DeepSeek Harness 对话框中:
在 DeepSeek Harness 中安装 ModLens 插件,请运行命令 `dsh plugin install liustack/modlens`,完整源码地址为 https://github.com/liustack/modlens 。
插件介绍
ModLens 解决的是一个很具体、也很恼人的问题:DeepSeek 和 GLM 的旗舰聊天模型都是纯文本的,它们看不到图片。过去你想让模型分析一张截图,得先把图存成文件,再把路径塞进对话里,步骤繁琐且体验割裂。ModLens 让这一切消失——你直接把图片粘贴到聊天窗口,它就自动读取、转写、理解,模型基于真实像素内容回答,而不是靠猜。整个体验就像给纯文本模型装上了一双眼睛,而且是即插即用的。
它的核心能力远超“看图说话”。ModLens 会输出完整的转录文本、阅读顺序布局、实体与关系列表,让模型能引用图中具体细节,而不是泛泛而谈。它支持一次粘贴多张图片,也能处理密集图表——比如包含 128 个模型对比的散点图,它能读出坐标轴、对数刻度、颜色编码和高亮区域。更贴心的是,它内置了六种视觉引擎和四个可复用的本地 CLI 登录,形成一条自动故障转移链:免费 Gemini 密钥最快,Claude Code、Codex、OpenCode、Pi 的现有登录也能按你的授权加入后备,任何一次读取都会标注消耗了谁的配额。安装极轻,在 DeepSeek Harness 上就是一个插件,卸载只需删掉一个文件夹。
适合谁用?如果你是 Claude Code、Codex、OpenCode、Pi 或 DeepSeek Harness 的用户,手头是纯文本模型,又经常需要分析截图、图表、UI 设计稿或长图文档,ModLens 就是为你准备的。它尤其适合那些不想折腾配置的人——零配置启动,能自动复用你机器上已有的登录和密钥;也适合追求隐私与透明度的人——所有图片内容被视为不可信输入,权限和抓取策略都写明了。一句话:如果你希望模型真的“看见”你粘贴的东西,而不是假装看见,ModLens 是目前最省心的方案。
截图预览
使用场景
- 粘贴截图即可分析界面与UI设计
- 读取图表数据并引用具体细节
- 一次粘贴多张图片进行内容识别
适合人员
- 使用纯文本模型的开发者
- 需要快速分析截图的日常用户
- 追求零配置体验的AI工具使用者





