DSH Plugins
返回列表
dsh-eyes

dsh-eyes

模型推理 更新于 2026.08.25

在终端中运行以下命令:

dsh plugin install qing9835/dsh-eyes

将以下提示词粘贴到 DeepSeek Harness 对话框中:

在 DeepSeek Harness 中安装 dsh-eyes 插件,请访问其开源仓库 https://github.com/qing9835/dsh-eyes 并使用提供的安装命令。

插件介绍

在深度使用 DeepSeek Harness 进行纯文本对话时,你是否常遇到需要“看”图片却只能“读”文字的尴尬?dsh-eyes 正是为了解决这一痛点而生。它像给聊天框装上了一双“眼睛”,能够智能拦截你粘贴、拖入或导入的图片,将其转化为文字内容,无缝融入对话流中。无论是一张复杂的截图还是一份文档,它都能迅速将其转化为可读文本,消除图片与文本模型之间的隔阂。

该插件的核心能力在于其灵活且强大的交互模式。你可以选择开启图片拦截,让插件自动识别缩略图并提取文字(支持一次最多9张),或者关闭拦截,将图片直接发送给多模态模型进行实时分析。它还支持 vision_ask 工具,能将识别结果与你的指令结合,让主模型在理解的基础上进行多轮追问与细节修正。此外,插件内置了多种模型预设,支持直接读取本地文件路径,适应各种工作流需求。

无论是需要进行复杂文档分析的研究者,还是习惯于图文混排的视觉工作者,dsh-eyes 都是提升效率的利器。它不仅简化了图片与文字的交互流程,更通过强大的工具链支持,让大模型不仅能“看”,还能在理解的基础上进行深度追问与细节修正。

截图预览

使用场景

  • 快速从截图中提取文字信息
  • 分析 PDF 报告或文档内容
  • 处理上传的图片并进行内容总结

适合人员

  • 需要处理文档和截图的研究人员
  • 使用 DeepSeek 进行高效多模态交互的用户
  • 需要视觉上下文进行推理的开发者