DSH Plugins
返回列表
🤖

dsh-image-mmx

模型推理 更新于 2026.08.25

在终端中运行以下命令:

dsh plugin install fengs2021/dsh-image-mmx

将以下提示词粘贴到 DeepSeek Harness 对话框中:

在 DeepSeek Harness 中安装该插件,请在终端执行 dsh plugin install fengs2021/dsh-image-mmx。源码地址:https://github.com/fengs2021/dsh-image-mmx

插件介绍

纯文本大模型(如 DeepSeek)通常无法直接处理图片,导致上传图片时系统报错。dsh-image-mmx 插件正是为了解决这一痛点而设计,它为文本模型装上了“眼睛”。当用户在对话中发送图片时,插件会自动将其落盘,并调用本地的 MMX(MiniMax VLM)进行视觉识别,将画面中的文字、布局等关键信息提取并转化为文本。随后,这些识别结果会被无缝注入到模型的上下文中,让纯文本模型也能理解图片内容。该插件不仅支持多图并行处理,还在 MMX 不可用时优雅降级为文件路径,确保交互的流畅性,非常适合需要处理图表、代码截图或界面信息的开发者使用。

使用场景

  • 处理代码截图或技术文档
  • 分析软件界面或图表
  • 上传图片进行智能解析

适合人员

  • 使用 DeepSeek 等纯文本模型的开发者
  • 需要从视觉信息中提取数据的用户
  • 希望为文本模型添加视觉能力的 AI 工作者