dsh-image-tools
在终端中运行以下命令:
dsh plugin install xiaoxianyu-office/dsh-image-tools
将以下提示词粘贴到 DeepSeek Harness 对话框中:
在 DeepSeek Harness 中,可通过运行 dsh plugin install xiaoxianyu-office/dsh-image-tools 命令安装此插件,完整源码地址为 https://github.com/xiaoxianyu-office/dsh-image-tools。
插件介绍
在使用纯文本大模型(如 DeepSeek)时,用户上传图片常会遇到 400 错误或功能缺失,因为模型本身不具备图像处理能力。dsh-image-tools 插件正是为解决这一痛点而生:它通过智能桥接机制,让纯文本模型无缝获得识图能力。插件会自动将聊天中的图片落盘,并动态禁用原生 read_image 以避免请求错误,转而提供对话式 image_recognize 工具,委派视觉子 agent(如小米 Mimo)进行精准识别。
其核心能力在于动态判定模型是否需要桥接:对于原生多模态模型(如 Qwen),插件保持原生链路;对于纯文本模型,则自动启用转存和委派流程。这确保了用户体验的连贯性,无需手动切换模型或配置复杂路由。识图输出严格遵循规范,提供像素坐标、色值等客观信息,避免模糊描述。
这个插件特别适合 DSH 框架用户,尤其是开发者或内容创作者,他们依赖 DeepSeek 等纯文本模型进行日常工作,但又需要图像分析功能。无论是快速识别图表、提取图片文字,还是进行视觉问答,dsh-image-tools 都能以低成本、高效率的方式扩展模型能力,让 AI 助手真正全能。
使用场景
- 纯文本模型聊天时上传图片自动落盘并识别
- 通过对话式工具委派视觉子agent分析图像内容
- 在DSH会话中处理图片并获取像素级精确描述
适合人员
- 使用DeepSeek等纯文本模型的开发者或用户
- 需要扩展模型图像能力的DSH框架使用者
- 依赖视觉数据分析的内容创作者或分析师