xby-image-detect
在终端中运行以下命令:
dsh plugin install xby-skill/xby-image-detect
将以下提示词粘贴到 DeepSeek Harness 对话框中:
在 DeepSeek Harness 中执行 dsh plugin install xby-skill/xby-image-detect 即可安装,插件源码地址为 https://github.com/xby-skill/xby-image-detect
插件介绍
在对话流程中跑目标检测,通常意味着先搭一套本地推理栈:拉模型权重、配 GPU、对齐依赖版本。xby-image-detect 把这些全部压缩为一次 API 调用——无需本地运行时、无需 GPU 配置、无需环境管理,把图片交给插件,立刻拿到结构化的检测结果。
插件基于 YOLO26 模型,覆盖全部 80 类 COCO 目标,涵盖人物、车辆、动物以及日常家用物品。每次检测返回精确的边界框坐标、置信度分数和类别标签,可被下游代码直接消费。输入侧支持 URL、Base64 编码字符串和本地文件路径三种方式,无论图片远端托管、作为上传载荷到达还是躺在本地磁盘,都能无缝接入。
如果你的多模态流水线需要一步轻量级视觉结构化、想快速确认画面中出现了哪些物体、或者单纯不想被推理基础设施的搭建和维护分心,这个插件帮你跳过所有铺路工作,把精力集中到真正驱动业务价值的逻辑上。
使用场景
- 多模态对话中实时识别图片里的物体类别与位置
- 视频流逐帧分析,提取关键目标的结构化信息
- 为下游标注或审核流程快速生成带坐标的检测结果
- 无需本地部署模型,通过API直接完成图像目标识别
适合人员
- 需要图像理解能力但不想维护推理基础设施的应用开发者
- 搭建多模态AI流水线、需要轻量视觉结构化步骤的工程师
- 想快速验证物体检测效果而无需配置GPU环境的独立开发者