dsh-vision-bridge
在终端中运行以下命令:
dsh plugin install GXX182/dsh-vision-bridge
将以下提示词粘贴到 DeepSeek Harness 对话框中:
在 DeepSeek Harness 中,使用命令 `dsh plugin install GXX182/dsh-vision-bridge` 安装插件,详情请访问 https://github.com/GXX182/dsh-vision-bridge。
插件介绍
在 DeepSeek Harness 中,许多模型是文本优先的,缺乏原生图像理解能力,这限制了用户处理图像相关任务,如视觉问答或图像分析。dsh-vision-bridge 插件旨在弥合这一差距,为文本模型添加一个视觉层,无需更改模型本身,从而扩展其功能范围。
该插件的核心能力包括集成多种视觉提供者(如 Gemini、OpenAI 兼容和 Anthropic 兼容 API),并通过直观的眼镜控制为每个模型启用或禁用图像理解。它安全地处理图像,将图像发送到配置的视觉提供者,并返回文本分析结果,同时保持模型列表简洁。此外,它支持持久化偏好设置,确保用户选择在会话中保持一致,并提供清晰的提供者来源信息。
适合那些使用 DeepSeek Harness 但需要图像分析功能的用户,例如开发者构建多模态应用、研究者进行视觉实验,或普通用户希望扩展文本模型的用途。它简化了为现有模型添加视觉能力的过程,无需复杂配置或模型切换,使得图像理解更加 accessible 和高效。
截图预览
使用场景
- 为文本模型添加图像分析能力
- 在视觉问答任务中使用
- 开发多模态应用时集成视觉功能
适合人员
- 需要图像理解功能的开发者
- 进行视觉实验的研究者
- 希望扩展文本模型用途的普通用户