DSH-Multimodal
在终端中运行以下命令:
dsh plugin install yauntyour/DSH-Multimodal
将以下提示词粘贴到 DeepSeek Harness 对话框中:
在 DeepSeek Harness 中安装 DSH-Multimodal 插件,请使用命令 `dsh plugin install yauntyour/DSH-Multimodal`,源码地址为 https://github.com/yauntyour/DSH-Multimodal。
插件介绍
许多强大的会话模型(如 DeepSeek)仅支持文本输入,直接向它们附加图片会报错,而视频或音频文件则完全无法处理。DSH-Multimodal 插件通过拦截发送路径,在文件进入会话模型前,利用您配置的视觉模型将其转化为详细的文字描述。它提供了灵活的设置页面,支持按文件类型配置独立的模型链,并具备智能回退机制,确保即使处理失败也能保证对话流畅。适合希望在不修改原生会话模型的情况下,利用外部多模态模型(如本地视觉模型)来理解图片、视频或音频内容的用户。无论您是想分析截图、处理媒体文件,还是构建复杂的多模态工作流,这款插件都能为您提供强大的支持,让纯文本模型也能具备“看”和“听”的能力。
使用场景
- 让 DeepSeek 等纯文本模型支持图片输入
- 分析截图、图表或视频/音频文件内容
- 为本地部署的视觉模型(如 Ollama)配置处理流程
适合人员
- 使用 DeepSeek 等文本模型的用户
- 需要视觉能力的本地大模型开发者
- 希望扩展 AI 助手功能的研究人员