xby-pic
在终端中运行以下命令:
dsh plugin install xby-skill/xby-pic
将以下提示词粘贴到 DeepSeek Harness 对话框中:
在终端执行 dsh plugin install xby-skill/xby-pic 即可安装该插件,源码位于 https://github.com/xby-skill/xby-pic
插件介绍
在对话式 AI 工作流中处理图片,往往需要对接几十种格式各异的图像 API——认证方式、请求结构、返回字段互不兼容,逐一对接既费时又容易出错。xby-pic 将三十余种图像理解能力统一封装为 DeepSeek Harness 插件,开发者只需调用一个插件入口,即可在对话中直接完成从文字识别到复杂目标检测的全部任务,免去繁琐的胶水代码。
核心能力覆盖三个层次:第一层是结构化信息提取,包括通用与高精度 OCR、手写识别、车牌、身份证、护照、港澳通行证、银行卡、营业执照、驾驶证、行驶证等证件识别,均支持链接、base64 编码和本地文件路径三种输入方式;第二层是行业场景检测,涵盖火焰、手势、行人、车辆、电动自行车、安全帽、反光衣、香烟等安防与交通常见目标;第三层是通用视觉模型,提供 ImageNet 千类分类、COCO 80 类检测与实例分割、旋转目标检测、人体 17 关键点姿态估计,以及覆盖五万多类的万物识别,还有昆虫、植物、鸟类、菜品、宠物情绪等细粒度识别。
适合在 DSH 对话管线中需要批量处理图像的开发者、自动化工作流搭建者,以及希望在单一工具集中兼顾证件审核、安防监控和通用视觉分类的业务团队。所有能力通过小笨羊统一 API 驱动,一次配置密钥即可全局使用。
使用场景
- 对话中快速提取证件结构与文字信息
- 安防监控场景下检测火焰、行人、车辆与安全帽
- 自动化管线中批量完成图像分类、实例分割与姿态估计
适合人员
- 在 DSH 工作流中需要图像理解能力的开发者
- 搭建证件审核与合规自动化流水线的业务团队
- 构建安防与交通视觉管线的解决方案工程师