视觉目标检测(VISUAL_OBJECT_DETECTION)— vision_detection
2026-09-22 19:05
计费规则:
G1 感知与运动能力工具链介绍
想检什么,说什么词就行。
基于开放词汇的实例分割检测,无需预定义类别,用自然语言即可让机器人识别并定位目标,输出带掩码的标注图与结构化数据(类别、置信度、位置、面积)。所见即所得,灵活应对未知场景。
 
  • 核心特点:自然语言定义目标、免重训即用、输出结构化
  • 典型场景:商品识别、货架盘点、开放场景物体检索

 

基于 YOLOE 的开放词汇实例分割:从 RealSense 采图后输出掩码叠加标注图与目标 JSON(类别、置信度、像素框、质心、面积),实现「用什么词检什么目标」的灵活检测。输入图像,输出标注图 + JSON,运行于 ROS 2 Foxy / Humble,依赖 ultralytics>=8.4.0。

 

下载地址:https://jszn-datasets.obs.cn-east-3.myhuaweicloud.com/datas/datasets/free/%E5%85%B7%E8%BA%AB%E6%99%BA%E8%83%BD%E5%85%A8%E6%A0%88%E5%BC%80%E5%8F%91%E5%B7%A5%E5%85%B7/07_%E8%A7%86%E8%A7%89%E7%9B%AE%E6%A0%87%E6%A3%80%E6%B5%8B_VISUAL_OBJECT_DETECTION.zip