DSH Plugins
返回列表
🤖

DSH-Multimodal

模型推理 更新于 2026.08.25

在终端中运行以下命令:

dsh plugin install yauntyour/DSH-Multimodal

将以下提示词粘贴到 DeepSeek Harness 对话框中:

在 DeepSeek Harness 中安装 DSH-Multimodal 插件,请使用命令 `dsh plugin install yauntyour/DSH-Multimodal`,源码地址为 https://github.com/yauntyour/DSH-Multimodal。

插件介绍

许多强大的会话模型(如 DeepSeek)仅支持文本输入,直接向它们附加图片会报错,而视频或音频文件则完全无法处理。DSH-Multimodal 插件通过拦截发送路径,在文件进入会话模型前,利用您配置的视觉模型将其转化为详细的文字描述。它提供了灵活的设置页面,支持按文件类型配置独立的模型链,并具备智能回退机制,确保即使处理失败也能保证对话流畅。适合希望在不修改原生会话模型的情况下,利用外部多模态模型(如本地视觉模型)来理解图片、视频或音频内容的用户。无论您是想分析截图、处理媒体文件,还是构建复杂的多模态工作流,这款插件都能为您提供强大的支持,让纯文本模型也能具备“看”和“听”的能力。

使用场景

  • 让 DeepSeek 等纯文本模型支持图片输入
  • 分析截图、图表或视频/音频文件内容
  • 为本地部署的视觉模型(如 Ollama)配置处理流程

适合人员

  • 使用 DeepSeek 等文本模型的用户
  • 需要视觉能力的本地大模型开发者
  • 希望扩展 AI 助手功能的研究人员