DSH Plugins
返回列表
🤖

dsh-pseudo-vision

模型推理 更新于 2026.08.26

在终端中运行以下命令:

dsh plugin install DDDFXYqiming/dsh-pseudo-vision

将以下提示词粘贴到 DeepSeek Harness 对话框中:

在 DeepSeek Harness 中安装此插件,请运行命令:dsh plugin install DDDFXYqiming/dsh-pseudo-vision,完整源码地址为 https://github.com/DDDFXYqiming/dsh-pseudo-vision。

插件介绍

在DeepSeek Harness中,纯文本模型往往缺乏视觉理解能力,这限制了它们在图像处理任务中的应用。dsh-pseudo-vision插件通过创新的本地工具层解决了这一问题,它自动将图像拆解为OCR文字、颜色统计、像素扫描和元信息,使任意纯文本模型也能“看图”。该插件接管路由,为纯文本模型生成支持图像的兄弟路由,在LLM dispatch时无缝转换图像为文本注入,无需外部视觉API,确保数据隐私和低延迟。

核心能力在于其强大的本地处理管线:利用tesseract.js进行高精度OCR(包括中文和英文识别),结合sharp进行颜色分析和像素扫描,全程本机执行。这意味着插件能有效提升纯文本模型在文档分析、图像描述等场景中的表现,同时避免依赖外部服务带来的成本和风险。安装后即生效,无需额外配置,适配现有工作流。

这款插件特别适合使用DeepSeek Harness的开发者、研究人员或普通用户,他们希望扩展纯文本模型的功能,处理多模态任务。无论是需要图像文本提取、视觉分析,还是追求本地化解决方案的隐私保护,dsh-pseudo-vision都能提供高效、便捷的支持,助力用户在AI应用中突破模型限制。

使用场景

  • 对文档图像进行文本提取和分析
  • 在无网络环境下处理视觉内容
  • 增强纯文本模型的多模态任务能力

适合人员

  • 使用DeepSeek Harness的AI开发者
  • 需要本地化图像处理的研究人员
  • 希望避免外部API依赖的普通用户