DSH Plugins
返回列表
🤖

dsh-vision-adapter

模型推理 更新于 2026.08.24

在终端中运行以下命令:

dsh plugin install motongv/dsh-vision-adapter

将以下提示词粘贴到 DeepSeek Harness 对话框中:

在 DSH Web 界面打开终端后执行 dsh plugin install motongv/dsh-vision-adapter,插件源码见 https://github.com/motongv/dsh-vision-adapter ,安装完成后重启 DSH 即可在设置中看到视觉配置页。

插件介绍

DeepSeek Harness 是一个强大的推理工作台,但它只有文本能力。用户需要理解一张截图、一张白板照片或一张数据图表时,工作流就会断裂——必须手动把图片内容转录成文字再喂回去。dsh-vision-adapter 正是为了补上这块拼图:安装并重启后,聊天模型下拉里直接出现两个视觉模型,拖一张图进对话,视觉模型负责描述、DeepSeek 负责推理,全程不出聊天界面。

配置几乎没有摩擦。插件内置八家视觉厂商预设——Kimi、智谱 GLM、通义千问、OpenAI、Google Gemini、豆包、MiniMax、阶跃星辰——打开设置与视觉页面,选一家、粘 Key、保存即可。接口地址、模型名、凭据引用全部预填,Key 安全写入 DSH 凭据文件,不残留在设置里。每家厂商对应 Pro 和 Flash 两种 DeepSeek 文本后端,切换厂商时模型标签自动同步。

底层实现在 DSH 进程内起一个 HTTP 桥,将视觉模型注册为 llm-pi-ai 提供方(增量合并,不覆盖其他插件),并内置了图片描述缓存、429 退避重试、角色归一化等实用细节。如果你日常在 DSH Web 里写代码、读论文、做分析,又不想像查一张图就跳到另一个前端,这个插件让你把视觉能力直接长在主工作流里。

使用场景

  • 在 DSH 聊天中直接拖入截图或白板照片,视觉模型描述后交 DeepSeek 推理
  • 阅读论文遇到图表时拖进对话即可理解内容,无需手动转录
  • 分析数据截图或 UI 设计稿,视觉描述与文本推理一步完成

适合人员

  • 日常使用 DSH Web 进行代码编写与文档分析的开发者
  • 需要频繁处理截图、图表、设计稿的多模态工作流用户
  • 希望在不切换前端的情况下为 DeepSeek 增加视觉能力的 Harness 用户