dsh-pdf-reader
在终端中运行以下命令:
dsh plugin install AngelosZou/dsh-pdf-reader
将以下提示词粘贴到 DeepSeek Harness 对话框中:
在 DeepSeek Harness 中执行 dsh plugin install AngelosZou/dsh-pdf-reader 即可安装该插件,源码位于 https://github.com/AngelosZou/dsh-pdf-reader
插件介绍
视觉模型读取 PDF 时常常顾此失彼:整页栅格化后双栏论文的小字号、上下标和矢量图形细节全部丢失,纯文本提取又无法呈现图表、表格和公式的空间结构。dsh-pdf-reader 用逐页内容感知策略化解这一矛盾,让每一页都以最合适的方式进入模型上下文。
插件基于 PyMuPDF 提供三个核心工具:pdf_scan 输出逐页内容画像(栏数、矢量区域、表格、公式风险等);pdf_read_page 以混合模式一次性返回低分辨率全页预览、页面文本以及自动检测到的图表区域高 DPI 渲染路径;pdf_render_region 支持对任意坐标区域按需高精度渲染。所有重内容写入缓存目录并以路径返回,绝不内联进上下文,天然适配视觉模型约 384 token 的单图上限。
适合需要让 AI 代理精读学术论文、技术白皮书或任何图文混排 PDF 的开发者。代理遵循预览、自动渲染、按需缩放三步循环即可,无需手动判断每页该用提取还是栅格化,也无需关心像素预算。
使用场景
- AI 代理精读双栏学术论文中的矢量图表、表格和公式
- 批量处理技术白皮书,自动区分纯文本页与图形密集页
- 在视觉模型单图 token 预算内完整保留表格结构和精细图形
适合人员
- 构建 PDF 阅读工作流的 AI 应用开发者
- 需要代理精读学术论文的科研人员
- 集成视觉模型处理图文混排文档的团队