dsh-local-ocr
在终端中运行以下命令:
dsh plugin install littlewrite/dsh-local-ocr
将以下提示词粘贴到 DeepSeek Harness 对话框中:
在终端中执行 dsh plugin install littlewrite/dsh-local-ocr,即可从 GitHub 仓库(https://github.com/littlewrite/dsh-local-ocr)将该插件安装到当前 DeepSeek Harness profile,安装完成后重启 dsh web 即可生效。
插件介绍
当你让 DeepSeek Harness 里的 agent 读取一张本地截图或文档图片中的文字时,最自然的期望是它能直接识别出来。dsh-local-ocr 正是为此而生:它把操作系统自带的 OCR 能力封装成一个 model-facing 工具,agent 只需传入本地图片的绝对路径,即可获得识别文本与置信度,全程无需任何云端服务。
插件底层通过 @napi-rs/system-ocr 桥接 macOS Vision OCR 与 Windows Media OCR,对上层暴露统一的 Node.js API。注册的 local_ocr_image 工具采用延迟加载策略——原生 add-on 只在模型真正调用工具的那一刻才载入,空闲时不产生额外进程开销。返回字段保持精简稳定:text 与 confidence;图片中无可识别文字时,text 为空字符串、confidence 为 0,不会抛出异常打断对话流。
适合在 macOS 或 Windows 上运行 DeepSeek Harness、又希望图片文字识别完全留在本地的开发者。插件以独立 bundle 挂载到 Harness profile,不修改 Harness 源码,不引入缓存层,也不替模型做是否跑 OCR 的决策,调用时机完全由 agent 自行判断。当前 MVP 暂不支持 Linux;如果你只需要一个轻量、可本地运行、与现有 Harness 工作流无缝衔接的 OCR 入口,它正好够用。
使用场景
- Agent 识别本地截图中的文字并提取关键信息
- 无网络环境下对文档图片进行离线文字提取
- 让 Harness agent 自动读取本地 PDF 截图的文本内容
适合人员
- 使用 DeepSeek Harness 的 macOS 或 Windows 开发者
- 需要本地 OCR 能力且不愿数据上云的应用团队
- 为 agent 工作流添加图片文字识别入口的插件开发者