标签
一位开发者利用 Roboflow RF-DETR 进行检测、MediaPipe 捕捉身体角度、OpenCV 进行分析和标注,构建了一个 AI 篮球教练。
YOLO26 是一个于2026年1月发布的多任务计算机视觉模型系列,具备无需 Non-Maximum Suppression 的端到端检测功能以降低延迟,并针对边缘部署进行了优化,具有改进的CPU推理能力和紧凑设计。
CIPER是一个统一的Transformer框架,能够联合执行城市级跨视图图像检索和精确的三自由度(3-DoF)姿态估计,克服了级联管道的局限性。
Ultralytics YOLO26 引入了一个统一的实时视觉模型家族,具有无需NMS的推理、改进的训练策略以及用于检测、分割和姿态估计的多任务能力,实现了最先进的精度与延迟权衡。
本综述将工业视觉仿真到现实重新定义为一种按先验可用性组织的域间隙问题,区分了CAD引导、CAD缺失和边界先验设置,从而将基于CAD的检测和6D姿态估计文献与通常单独综述的工业异常及表面检测文献联系起来。
说明“无标记”动作捕捉仍然使用标记,但通过网络摄像头估算,而非昂贵设备,从而实现多人、尺度感知的捕捉。
SignX提出了一种用于连续手语识别的新框架,该框架将异构姿态格式统一到紧凑的潜在空间中,并在像素空间基线基础上实现50倍计算加速,同时达到最先进的准确率。
RuView 是一个开源 WiFi 传感平台,利用来自低成本 ESP32 传感器的信道状态信息(CSI)来检测人员、追踪运动、测量生命体征,以及在不使用摄像头或穿戴设备的情况下估计穿透墙壁的姿态。该系统完全在边缘硬件上运行,具有密码学证明机制,并使用脉冲神经网络进行本地自适应。