DSH Plugins
返回列表
🤖

dsh-llm-vision-bridge

模型推理 更新于 2026.08.25

在终端中运行以下命令:

dsh plugin install Einskyle/dsh-llm-vision-bridge

将以下提示词粘贴到 DeepSeek Harness 对话框中:

在 DeepSeek Harness 中,运行 `dsh plugin install Einskyle/dsh-llm-vision-bridge` 来安装此插件,源码地址为 https://github.com/Einskyle/dsh-llm-vision-bridge。

插件介绍

文本-only 的大型语言模型如 DeepSeek 在处理图像时面临挑战,无法直接解析用户上传的图片内容,这在需要多模态交互的场景中造成了障碍。dsh-llm-vision-bridge 插件巧妙地解决了这一问题,它通过桥接架构,将图像自动路由至视觉模型进行描述,并将生成的文本反馈给 DeepSeek,从而模拟原生多模态能力,让对话更自然流畅。核心能力在于其无缝集成:插件注册为原生 LLM 提供商,无图像时零开销,通过 LRU 缓存避免重复描述,并支持自动重试以应对资源竞争。这种设计使得用户无需更改 UI 或前端代码,即可在聊天中轻松分享图片并获得基于上下文的回复。该插件适合广泛用户群体,包括研究人员、AI 开发者和内容创作者,他们希望扩展文本 LLM 的功能,实现更丰富的交互体验,同时保持隐私和性能平衡。

使用场景

  • 在聊天中上传图片并获取基于描述的文本回复。
  • 使用DeepSeek处理图像内容,无需更换模型。
  • 实现无UI更改的多模态交互,提升对话丰富度。

适合人员

  • AI开发者扩展LLM的图像处理能力。
  • 研究人员进行多模态实验和应用。
  • 内容创作者通过图像增强对话体验。