dsh-plugin-multimodal
在终端中运行以下命令:
dsh plugin install shinjiyu/dsh-plugin-multimodal
将以下提示词粘贴到 DeepSeek Harness 对话框中:
在 DeepSeek Harness 中,运行命令 dsh plugin install shinjiyu/dsh-plugin-multimodal 安装插件,然后重启 dsh web 以生效。源码地址:https://github.com/shinjiyu/dsh-plugin-multimodal
插件介绍
在 DeepSeek Harness 中,官方默认只支持纯文本输入,粘贴图片时会收到“当前模型不支持图片”的错误。这给需要引用截图、图表或其他视觉内容的用户带来了不便。本插件正是为了解决这一痛点而生,它提供了贴图准入功能,确保图片粘贴不会被系统拒绝。
核心能力在于智能适配不同的主模型:如果当前模型本身具备视觉能力(如 Claude 或 GPT),插件会原样将图片传递给模型处理;如果主模型是纯文本的(如官方 DeepSeek),插件则会先通过一个可配置的视觉 sidecar 将图片内容转换为文字描述,再将文字传递给主模型,从而让纯文本模型也能间接获取图片信息。这种设计既保持了兼容性,又实现了无缝的图片支持。
本插件适合所有在 DeepSeek Harness 中需要处理图片内容的用户,尤其是那些依赖纯文本模型但偶尔需要分析截图错误日志、网页设计稿或数据图表的人。无论你是开发者、研究人员还是日常用户,只要想让对话中包含图片元素而不被中断,这个插件都能提供轻量级的解决方案。它专注于让粘贴不被拒,而非构建复杂的视觉工具箱,因此非常适合追求简单高效的场景。
使用场景
- 粘贴报错截图并询问红字内容
- 通过视觉模型直接处理图片
- 将磁盘截图转换为文字传递给主模型
适合人员
- 使用纯文本模型的用户
- 需要分析图片内容的开发者
- 想在对话中引用截图的研究人员