dsh-mingmu
在终端中运行以下命令:
dsh plugin install Lab-sku/dsh-mingmu
将以下提示词粘贴到 DeepSeek Harness 对话框中:
在 DeepSeek Harness 中执行安装命令,或从开源地址 https://github.com/Lab-sku/dsh-mingmu 获取源码进行安装。
插件介绍
你在用纯文本 LLM 写代码或做研究时,把一张截图贴了进去,模型礼貌地告诉你它没有视觉能力。dsh-mingmu(明眸)就是为这一刻而生的:它在 DeepSeek Harness 运行时层加了一条透明的视觉桥。当检测到当前模型确实不支持图片输入时,它悄悄把附件交给视觉模型识别,将返回的文字描述注入主模型上下文,用户完全无感;若当前模型本身就是原生视觉模型,桥接直接让路,不做任何拦截。
插件围绕两个核心原则设计:智能路由与优雅降级。内置启发式规则覆盖 OpenAI、Anthropic、Google、Qwen、Kimi、GLM、DeepSeek-VL 等二十余个视觉模型家族,对约 98% 的视觉模型能正确识别;拿不准的宁可多走一次桥接也不漏掉。默认 cascade 策略先调用首选模型,失败或结果为空时自动升级备选;高级用户可切换 race 模式让多个候选并发赛跑取最优。所有配置均可通过 dsh Web 设置页实时调整,也可用环境变量控制,API Key 存入 dsh 官方凭据库,不落盘到插件配置。
明眸适合主力模型为纯文本 LLM(DeepSeek 基础版、Qwen 文本等)却经常需要解读截图、图表、UI 原型或示意图的团队与个人。装好之后,不再需要来回切换两个模型或手写 OCR-再-提示词脚本——直接贴图、继续对话,体验与原生视觉模型一致。
截图预览
使用场景
- 纯文本文本模型无法查看截图需自动补全视觉能力
- 需要主力模型解读图表、UI 原型或示意图时
- 不想来回切换模型或手写 OCR-再-提示词脚本时
适合人员
- 以纯文本 LLM 为主力模型但频繁需要看图的开发团队
- 需要让模型分析截图、图表或文档图片的研究人员
- 希望零源码改动、即装即用的 dsh 插件用户
