DSH Plugins
返回列表
🖥️

dsh-image-auto-describe

客户端 更新于 2026.08.18

在终端中运行以下命令:

dsh plugin install oldHan2423/dsh-image-auto-describe

将以下提示词粘贴到 DeepSeek Harness 对话框中:

在 DeepSeek Harness 终端执行 dsh plugin install oldHan2423/dsh-image-auto-describe 即可安装,插件源码位于 https://github.com/oldHan2423/dsh-image-auto-describe ,安装后执行一次宿主补丁并重启即可生效。

插件介绍

DeepSeek Harness 的主力模型(如 deepseek-v4-pro)只处理文字。你往对话里贴一张截图、一份报错日志或一个表格,消息会被直接拒绝粘贴。而「发张图问个问题」恰恰是最自然的交互方式,这个落差让体验卡在门口。

dsh-image-auto-describe 用一步全自动操作补上这个缺口。消息附带图片时,插件静息地调用视觉模型(默认 SiliconFlow 的 Qwen3-VL-32B 或 Zhipu 的 GLM-4V-Flash)将图片转写为文字——报错码、日志、表格、聊天记录逐字摘录——再把这段文字交给你的 DeepSeek 模型继续对话。转写期间对话里只出现一条低调的占位提示,完成后自动变为正式消息,原图仍可点开预览。所有视觉路由均失败时,插件回退到原始拒绝提示,绝不编造内容。视觉路由可直接在 Web 设置页切换,保存即生效,无需重启。会话模型看到的始终是转写文本,token 成本与文字长度挂钩,与图片体积无关。

适合所有在 Harness 中运行纯文字主力模型、又经常粘贴截图、错误日志、数据表格或聊天记录的开发者与使用者。前提条件很轻:profile 中已组合至少一条多模态视觉路由(如 SiliconFlow 或 Zhipu)并配置好 API Key 即可。插件本身不注册模型提供者,它只拦截准入层、把图片翻译成文字,然后把后续的推理交回给你的会话模型。

使用场景

  • 把截图、报错日志或表格贴进对话,让纯文字模型也能逐字读懂内容
  • 将图表与聊天记录自动摘录为文字后继续讨论,无需手动誊抄
  • 视觉模型调用全程透明,失败时如实回退拒绝,绝不编造未看到的内容

适合人员

  • 使用 deepseek-v4-pro 等纯文字主力模型、常需贴图提问的开发者
  • 频繁粘贴截图、日志、数据表格的 Harness 日常使用者
  • 已配置 SiliconFlow 或 Zhipu 等视觉 API Key 的部署运维人员