DSH Plugins
返回列表
🤖

dsh-local-ocr

模型推理 更新于 2026.08.16

在终端中运行以下命令:

dsh plugin install littlewrite/dsh-local-ocr

将以下提示词粘贴到 DeepSeek Harness 对话框中:

在终端中执行 dsh plugin install littlewrite/dsh-local-ocr,即可从 GitHub 仓库(https://github.com/littlewrite/dsh-local-ocr)将该插件安装到当前 DeepSeek Harness profile,安装完成后重启 dsh web 即可生效。

插件介绍

当你让 DeepSeek Harness 里的 agent 读取一张本地截图或文档图片中的文字时,最自然的期望是它能直接识别出来。dsh-local-ocr 正是为此而生:它把操作系统自带的 OCR 能力封装成一个 model-facing 工具,agent 只需传入本地图片的绝对路径,即可获得识别文本与置信度,全程无需任何云端服务。

插件底层通过 @napi-rs/system-ocr 桥接 macOS Vision OCR 与 Windows Media OCR,对上层暴露统一的 Node.js API。注册的 local_ocr_image 工具采用延迟加载策略——原生 add-on 只在模型真正调用工具的那一刻才载入,空闲时不产生额外进程开销。返回字段保持精简稳定:text 与 confidence;图片中无可识别文字时,text 为空字符串、confidence 为 0,不会抛出异常打断对话流。

适合在 macOS 或 Windows 上运行 DeepSeek Harness、又希望图片文字识别完全留在本地的开发者。插件以独立 bundle 挂载到 Harness profile,不修改 Harness 源码,不引入缓存层,也不替模型做是否跑 OCR 的决策,调用时机完全由 agent 自行判断。当前 MVP 暂不支持 Linux;如果你只需要一个轻量、可本地运行、与现有 Harness 工作流无缝衔接的 OCR 入口,它正好够用。

使用场景

  • Agent 识别本地截图中的文字并提取关键信息
  • 无网络环境下对文档图片进行离线文字提取
  • 让 Harness agent 自动读取本地 PDF 截图的文本内容

适合人员

  • 使用 DeepSeek Harness 的 macOS 或 Windows 开发者
  • 需要本地 OCR 能力且不愿数据上云的应用团队
  • 为 agent 工作流添加图片文字识别入口的插件开发者