DSH Plugins
返回列表
🤖

dsh-vision-sidecar

模型推理 更新于 2026.08.25

在终端中运行以下命令:

dsh plugin install 121103qwq/dsh-vision-sidecar

将以下提示词粘贴到 DeepSeek Harness 对话框中:

在 DeepSeek Harness 中安装此插件,请运行命令 dsh plugin install 121103qwq/dsh-vision-sidecar,完整源码地址为 https://github.com/121103qwq/dsh-vision-sidecar。

插件介绍

DeepSeek Harness 中的文本模型天生无法处理图像,传统方案要么替换整个推理模型,要么需要部署本地视觉模型并配备 GPU 和密钥。dsh-vision-sidecar 巧妙地绕过了这些限制,它作为一个轻量级插件,为现有文本模型注入了视觉感知能力。无需改动核心推理引擎,插件将图像发送到免费的 LLM7.io 端点或用户自定义的视觉 API,生成详细描述后,将其作为可持久化的会话消息保存,供推理模型后续使用。这样,文本模型就间接“看到”了图像内容,而整个过程对用户透明且资源开销极小。

插件的核心能力在于其“无密钥”默认配置与持久化设计。开箱即用时,它依赖 LLM7.io 提供的匿名视觉服务,用户无需申请任何 API 密钥或部署本地环境,降低了使用门槛。生成的视觉描述会作为一条正式的会话消息写入 DSH 持久层,即使进程重启,之前的图像分析结果也能被准确回放,避免了重复调用和额度浪费。同时,插件支持灵活配置,用户可以轻松替换底层的视觉提供方或推理目标模型,适应不同的隐私需求或性能偏好。

这个插件尤其适合那些希望快速扩展 DeepSeek Harness 多模态能力,又不想涉及复杂模型迁移或基础设施变更的开发者、研究人员和普通用户。如果你正在构建需要处理图文混合输入的应用,但受限于文本模型的纯文本接口,dsh-vision-sidecar 提供了一种简洁、低成本的升级路径。它让视觉理解变得像调用普通 API 一样简单,同时保持了系统的稳定性和可维护性。

使用场景

  • 为纯文本模型添加图像理解能力。
  • 在不需要本地 GPU 的情况下处理图像。
  • 持久化视觉描述以供后续对话重用。

适合人员

  • 需要扩展 DeepSeek Harness 多模态能力的开发者。
  • 希望使用免费视觉 API 的用户。
  • 追求系统透明性和安全性的研究人员。