DSH Plugins
返回列表
🤖

picturereader

模型推理 更新于 2026.08.26

在终端中运行以下命令:

dsh plugin install jing-hy/picturereader

将以下提示词粘贴到 DeepSeek Harness 对话框中:

在 DeepSeek Harness 中,可以通过插件安装入口使用源码地址 https://github.com/jing-hy/picturereader 安装该插件。

插件介绍

picturereader 解决的是纯文本模型无法直接理解图片和文档的问题。DeepSeek 等文本模型本身没有视觉编码器,粘贴图片往往会变成不可处理的内容;这个插件通过视觉孪生 adapter,为勾选的模型生成带“视觉”标识的变体,让 DSH 能够显示原生缩略图,并在请求进入模型前把图片转成本地路径、像素证据和文本引导,使模型始终以纯文本方式继续推理。

插件的核心能力是一套完整的本地读图与图像处理链路:它提供图片扫描、区域裁剪、像素取样、颜色提取、图片对比、批量验证和 OCR 识别,并支持把 PDF、Word、Excel、PPT 等文档逐页转成图片再进行分析。v3.2.0 还加入了 image_edit 本地修图工具,可进行缩放、旋转、滤镜、水印、合成、去背景、拼接、透视校正等纯 CPU 操作;同时提供隐私、智能、严谨三种路由模式,按需决定是否调用可选的外部视觉 API。

它适合希望让纯文本模型获得看图和读文档能力的用户,尤其是需要处理截图、扫描件、合同、表格、图表或图片批量分析的人。对隐私敏感、希望图片尽量不出本机的场景,也可以使用隐私模式完全依赖本地工具完成分析。

使用场景

  • 让纯文本模型读取截图、照片或扫描件
  • 将 PDF、Word、Excel、PPT 转成图片逐页分析
  • 在本机完成裁剪、水印、拼接等图片处理

适合人员

  • 使用 DeepSeek 等纯文本模型的开发者
  • 需要处理截图、合同、表格和图表的用户
  • 重视隐私、希望尽量离线处理图片的用户