dsh-image-mmx
在终端中运行以下命令:
dsh plugin install fengs2021/dsh-image-mmx
将以下提示词粘贴到 DeepSeek Harness 对话框中:
在 DeepSeek Harness 中安装该插件,请在终端执行 dsh plugin install fengs2021/dsh-image-mmx。源码地址:https://github.com/fengs2021/dsh-image-mmx
插件介绍
纯文本大模型(如 DeepSeek)通常无法直接处理图片,导致上传图片时系统报错。dsh-image-mmx 插件正是为了解决这一痛点而设计,它为文本模型装上了“眼睛”。当用户在对话中发送图片时,插件会自动将其落盘,并调用本地的 MMX(MiniMax VLM)进行视觉识别,将画面中的文字、布局等关键信息提取并转化为文本。随后,这些识别结果会被无缝注入到模型的上下文中,让纯文本模型也能理解图片内容。该插件不仅支持多图并行处理,还在 MMX 不可用时优雅降级为文件路径,确保交互的流畅性,非常适合需要处理图表、代码截图或界面信息的开发者使用。
使用场景
- 处理代码截图或技术文档
- 分析软件界面或图表
- 上传图片进行智能解析
适合人员
- 使用 DeepSeek 等纯文本模型的开发者
- 需要从视觉信息中提取数据的用户
- 希望为文本模型添加视觉能力的 AI 工作者