dsh-ext-vision-proxy
在终端中运行以下命令:
dsh plugin install jin123-alpha/dsh-ext-vision-proxy
将以下提示词粘贴到 DeepSeek Harness 对话框中:
要安装 dsh-ext-vision-proxy 插件,请运行命令 `dsh plugin install jin123-alpha/dsh-ext-vision-proxy`,完整源码地址为 https://github.com/jin123-alpha/dsh-ext-vision-proxy。
插件介绍
在使用纯文本大语言模型(如 DeepSeek-V3 或 DeepSeek-R1)时,用户常常面临无法直接分析图像的困境,导致多模态任务受限。dsh-ext-vision-proxy 插件应运而生,它作为一座智能桥梁,将强大的视觉能力无缝注入这些纯文本模型中。通过代理调用 OpenAI 兼容的视觉模型 API,插件让 LLM 能够自主调用 vision_describe 工具来检查、分析和理解图像、截图或图表,从而扩展了模型的应用边界。
该插件的核心能力在于其无缝集成和灵活管理。它直接嵌入 DeepSeek Harness 的聊天界面,提供一个直观的开关和模型选择器,用户可以轻松激活或关闭视觉代理功能。插件支持多种图像来源(如本地文件、URL 和哈希引用),并自动解析 MIME 类型,确保图像被正确处理。此外,它具备四种状态会话矩阵,根据模型类型和开关状态智能调整行为,既保证了纯文本模型的代理调用,又允许多模态模型原生处理图像,避免了干扰。
dsh-ext-vision-proxy 特别适合所有使用 DeepSeek 纯文本模型的开发者、研究人员和终端用户,尤其是那些需要在不更换模型的前提下快速添加图像理解能力的场景。无论是构建交互式应用、进行数据分析,还是在教育或创意领域探索多模态交互,这个插件都能提供简洁而强大的支持,让纯文本 LLMs 突破局限,拥抱更丰富的视觉任务。
截图预览
使用场景
- 在聊天对话中无缝分析上传的图像或截图
- 为纯文本大语言模型添加视觉理解能力
- 通过OpenAI兼容API代理处理图像附件
适合人员
- 使用DeepSeek纯文本模型的开发者
- 需要图像处理功能的研究人员
- 探索多模态交互的终端用户
