DSH Plugins
返回列表
🖥️

dsh-pdf-reader

客户端 更新于 2026.08.26

在终端中运行以下命令:

dsh plugin install AngelosZou/dsh-pdf-reader

将以下提示词粘贴到 DeepSeek Harness 对话框中:

在 DeepSeek Harness 中执行 dsh plugin install AngelosZou/dsh-pdf-reader 即可安装该插件,源码位于 https://github.com/AngelosZou/dsh-pdf-reader

插件介绍

视觉模型读取 PDF 时常常顾此失彼:整页栅格化后双栏论文的小字号、上下标和矢量图形细节全部丢失,纯文本提取又无法呈现图表、表格和公式的空间结构。dsh-pdf-reader 用逐页内容感知策略化解这一矛盾,让每一页都以最合适的方式进入模型上下文。

插件基于 PyMuPDF 提供三个核心工具:pdf_scan 输出逐页内容画像(栏数、矢量区域、表格、公式风险等);pdf_read_page 以混合模式一次性返回低分辨率全页预览、页面文本以及自动检测到的图表区域高 DPI 渲染路径;pdf_render_region 支持对任意坐标区域按需高精度渲染。所有重内容写入缓存目录并以路径返回,绝不内联进上下文,天然适配视觉模型约 384 token 的单图上限。

适合需要让 AI 代理精读学术论文、技术白皮书或任何图文混排 PDF 的开发者。代理遵循预览、自动渲染、按需缩放三步循环即可,无需手动判断每页该用提取还是栅格化,也无需关心像素预算。

使用场景

  • AI 代理精读双栏学术论文中的矢量图表、表格和公式
  • 批量处理技术白皮书,自动区分纯文本页与图形密集页
  • 在视觉模型单图 token 预算内完整保留表格结构和精细图形

适合人员

  • 构建 PDF 阅读工作流的 AI 应用开发者
  • 需要代理精读学术论文的科研人员
  • 集成视觉模型处理图文混排文档的团队