DSH Plugins
返回列表
🤖

dsh-plugin-image-input

模型推理 更新于 2026.08.25

在终端中运行以下命令:

dsh plugin install Elohia/dsh-plugin-image-input

将以下提示词粘贴到 DeepSeek Harness 对话框中:

在 DeepSeek Harness 终端中运行 dsh plugin install Elohia/dsh-plugin-image-input 即可安装,源码地址见 https://github.com/Elohia/dsh-plugin-image-input ,安装后重启 DSH Web 生效。

插件介绍

用 DeepSeek、GPT-4 base 等纯文本大模型时,往对话里粘一张 K 线图或截图,模型要么直接拒绝、要么瞎编。dsh-plugin-image-input 解决的就是这个断点:粘贴或拖拽图片后按发送,插件自动调用你配置的视觉 API 把图转成结构化文字描述(画布元素、百分比坐标),再连同你的文字一起交给文本模型,让它在完全看不到像素的情况下也能处理图表和截图。

插件对多模态模型(qwen-vl、gpt-4o 等)完全放行,走原生图片通道,不插任何中间步骤。你也可以点输入框旁的「图片转文字」按钮,只把描述插进输入框、自己改完再发,适合需要二次编辑描述措辞的场景。多张图片逐张转换、合并发送,全程不丢内容。

适合在 DSH 里用非多模态后端、又经常需要让模型理解图表或界面截图的开发者。配置一次(baseUrl、模型名、API Key)即可在任意 OpenAI 兼容视觉端点上工作,不依赖本机沙箱,Windows、Linux、macOS 通用。

使用场景

  • 用 DeepSeek 后端让模型理解 K 线图和财务截图
  • 在纯文本对话中粘贴 UI 截图并分析布局与元素
  • 用 GPT-4 base 处理图表数据而不切换到多模态模型

适合人员

  • 使用非多模态后端的 DSH 用户
  • 经常需要模型理解图表或截图的开发者
  • 希望用同一文本模型处理多种输入类型的工程师