@LeRobotHF:100,000小时的人类双手进行真实工作。LeRobot格式,完全标注且开放。EgoSuite-Open100K来自@LightwheelAI

X AI KOLs Following 新闻

摘要

LightwheelAI和Hugging Face发布了EgoSuite-Open100K,这是一个包含100,000小时第一人称视角人类活动的大规模开放数据集,完全标注并以LeRobot格式提供,用于AI研究和训练。

100,000小时的人类双手进行真实工作。LeRobot格式,完全标注且开放。 EgoSuite-Open100K由@LightwheelAI和@huggingface推出:超过15,000个任务,涵盖15,000多个真实场景,包括手部、身体姿势和腕部摄像头。 录制跨越7个环境类别和128种场景类型,从厨房和卧室到仓库地板和装配线。 它开放用于学术研究和商业训练,并直接从Hub流式获取。看到如此规模的数据集在Hub上公开发布总是很棒的。 更多信息:http://hf.co/collections/LightwheelAI/egosuite-open100k…
查看原文
查看缓存全文

缓存时间: 2026/08/23 13:49

10万小时人类双手真实作业数据。采用LeRobot格式,完全标注且开放获取。

由@LightwheelAI 与 @huggingface 联合发布 EgoSuite-Open100K:涵盖超过15,000项任务、15,000+真实场景,包含手部与身体姿态及腕部摄像头数据。

数据采集横跨7大环境类别与128种场景类型,从厨房卧室到仓库地面与装配线全面覆盖。

该数据集开放用于学术研究与商业训练,可直接从数据平台获取。如此大规模数据集能在平台上开放发布,始终令人振奋。

更多信息请访问:http://hf.co/collections/LightwheelAI/egosuite-open100k…


EgoSuite-Open100K - LightwheelAI数据集合集

来源:https://huggingface.co/collections/LightwheelAI/egosuite-open100k

LightwheelAI (https://huggingface.co/LightwheelAI) 数据集合集

EgoSuite-Open100K (https://huggingface.co/collections/LightwheelAI/egosuite-open100k)

更新于4天前

全球最大的全标注开放自人类视角数据集。涵盖15,000+任务与场景,共计10万小时数据。

点赞数 27 (https://huggingface.co/login?next=%2Fcollections%2FLightwheelAI%2Fegosuite-open100k)-

  • — #### LightwheelAI/EgoStandard 更新于1天前 • 4.85千次使用 • 22点赞 (https://huggingface.co/datasets/LightwheelAI/EgoStandard)

  • — #### LightwheelAI/EgoPro 更新于1天前 • 6.02千次使用 • 16点赞 (https://huggingface.co/datasets/LightwheelAI/EgoPro)

  • — #### LightwheelAI/EgoDemo 更新于2天前 • 6.28千次使用 • 14点赞 (https://huggingface.co/datasets/LightwheelAI/EgoDemo)

点赞数 27 (https://huggingface.co/login?next=%2Fcollections%2FLightwheelAI%2Fegosuite-open100k)-

  • 合集指南 (https://huggingface.co/docs/hub/collections)

  • 浏览合集 (https://huggingface.co/collections)

相似文章

HumanNet:将以人为本的视频学习扩展至百万小时规模

Hugging Face Daily Papers

HumanNet 是一个包含百万小时标注视频的大规模以人为本的视频数据集,旨在训练视觉-语言-动作模型。它证明了以第一人称视角拍摄的人类视频可以有效地替代机器人数据,用于具身智能任务。

Ego2Robot:从第一人称人类数据规模化合成机器人数据

Hugging Face Daily Papers

Ego2Robot是一个可扩展的流水线,通过动作重定向和视觉合成,将第一人称人类操作视频转换为机器人训练数据,生成涵盖15种机器人形态的18,561小时数据。实验表明,在该合成数据与真实机器人数据上联合预训练,可提升视觉-语言-动作模型在分布外场景下的泛化能力,并已在真实机器人部署中得到验证。