按标签浏览
# 图片理解 / Image Comprehension(13)
deepseek-vl-support 插件为 AI 模型添加视觉能力,自动将图片发送到视觉服务获取描述,使模型能理解错误截图、UI 模型等视觉内容。
为 DeepSeek Harness 添加免费图片理解能力的插件,通过 OpenRouter 视觉模型自动处理图片,让纯文本模型也能理解图像。
为纯文本 DeepSeek 主代理添加视觉路由,将图片交由外部视觉提供商分析后以文字描述回传,实现图片理解能力。
为 DSH 智能体注册 vision_analyze 视觉分析工具,通过可配置的多模态模型实现图片 OCR、截图分析与图表理解,零依赖且持久化全局可用。
为 DeepSeek 增加原生图片上传,利用智谱 GLM 自动识别图片内容。
为DSH无视觉主模型提供图片理解能力:会话收图、自动转文字描述、内置view_image工具,对接任意OpenAI兼容视觉接口。
为无视觉能力的纯文本LLM提供图片输入接管:粘贴或拖拽图片后自动转为文字描述再发送,多模态模型则走原生通道直接放行。
为无视觉能力的主模型提供图片分析工具,将本地文件或图片 URL 发送至 OpenAI 兼容视觉模型并返回文字描述。
自动将对话中附加的图片经视觉模型转为文字描述注入上下文,让 DeepSeek 等纯文本模型也能理解图片,支持多模型回退与指数退避重试。
让 DeepSeek 理解图片,支持粘贴截图或本地 JPEG/PNG/WebP 文件,通过 MindSee 描述后作答,无需切换视觉模型。
为 DSH 添加视觉识别能力,拖图即可识别,内置 8 家视觉厂商预设,图片走视觉模型、文字走 DeepSeek 推理,聊天入口不变。
让纯文本模型读取图片:截获请求流,调用视觉模型转写图中内容,再将文本注入对话,无需切换模型。