DSH Plugins
返回列表
🤖

dsh-plugin-multimodal

模型推理 更新于 2026.08.25

在终端中运行以下命令:

dsh plugin install shinjiyu/dsh-plugin-multimodal

将以下提示词粘贴到 DeepSeek Harness 对话框中:

在 DeepSeek Harness 中,运行命令 dsh plugin install shinjiyu/dsh-plugin-multimodal 安装插件,然后重启 dsh web 以生效。源码地址:https://github.com/shinjiyu/dsh-plugin-multimodal

插件介绍

在 DeepSeek Harness 中,官方默认只支持纯文本输入,粘贴图片时会收到“当前模型不支持图片”的错误。这给需要引用截图、图表或其他视觉内容的用户带来了不便。本插件正是为了解决这一痛点而生,它提供了贴图准入功能,确保图片粘贴不会被系统拒绝。

核心能力在于智能适配不同的主模型:如果当前模型本身具备视觉能力(如 Claude 或 GPT),插件会原样将图片传递给模型处理;如果主模型是纯文本的(如官方 DeepSeek),插件则会先通过一个可配置的视觉 sidecar 将图片内容转换为文字描述,再将文字传递给主模型,从而让纯文本模型也能间接获取图片信息。这种设计既保持了兼容性,又实现了无缝的图片支持。

本插件适合所有在 DeepSeek Harness 中需要处理图片内容的用户,尤其是那些依赖纯文本模型但偶尔需要分析截图错误日志、网页设计稿或数据图表的人。无论你是开发者、研究人员还是日常用户,只要想让对话中包含图片元素而不被中断,这个插件都能提供轻量级的解决方案。它专注于让粘贴不被拒,而非构建复杂的视觉工具箱,因此非常适合追求简单高效的场景。

使用场景

  • 粘贴报错截图并询问红字内容
  • 通过视觉模型直接处理图片
  • 将磁盘截图转换为文字传递给主模型

适合人员

  • 使用纯文本模型的用户
  • 需要分析图片内容的开发者
  • 想在对话中引用截图的研究人员