dsh-glm-vision
在终端中运行以下命令:
dsh plugin install fightingFirefox/dsh-glm-vision
将以下提示词粘贴到 DeepSeek Harness 对话框中:
在 DeepSeek Harness 中运行 dsh plugin install fightingFirefox/dsh-glm-vision,源码地址:https://github.com/fightingFirefox/dsh-glm-vision
插件介绍
DeepSeek 等文本主模型擅长推理与工具编排,却无法直接解读图片。dsh-glm-vision 将智谱 GLM 视觉模型以独立供应商路由的形式接入 DeepSeek Harness,让文本模型继续负责动脑,GLM 只负责当眼睛,两者各司其职。
插件注册了 glm_vision 工具,主模型可在对话中随时调用它对本地图片生成文字描述;同时提供 GLM 纯文本加视觉补充路由,支持工具调用的多轮对话,纯文本 GLM 模型也能间接看图。插件还能接管 DeepSeek 官方路由,上传图片后自动引导主模型调用视觉工具,设置面板可调节思考深度、超时与默认模型。
适合已在 DeepSeek Harness 中运行文本主模型、需要图片理解能力但不想更换技术栈的开发者。只需一个智谱 API Key 即可使用,内置共存检测机制会在发现其他视觉插件时自动休眠,避免路由冲突。
使用场景
- 文本主模型在对话中调用 GLM 视觉工具理解图片内容
- 上传图片后由主模型自动触发视觉描述再作答
- 在模型选择器中直接选用 GLM 视觉模型进行带图问答
适合人员
- 已在 DeepSeek Harness 中运行文本主模型的开发者
- 需要为纯文本模型补充图片理解能力的用户
- 希望以独立路由方式接入智谱 GLM 视觉模型的开发者