@LeRobotHF:100,000小时的人类双手进行真实工作。LeRobot格式,完全标注且开放。EgoSuite-Open100K来自@LightwheelAI
摘要
LightwheelAI和Hugging Face发布了EgoSuite-Open100K,这是一个包含100,000小时第一人称视角人类活动的大规模开放数据集,完全标注并以LeRobot格式提供,用于AI研究和训练。
查看缓存全文
缓存时间: 2026/08/23 13:49
10万小时人类双手真实作业数据。采用LeRobot格式,完全标注且开放获取。
由@LightwheelAI 与 @huggingface 联合发布 EgoSuite-Open100K:涵盖超过15,000项任务、15,000+真实场景,包含手部与身体姿态及腕部摄像头数据。
数据采集横跨7大环境类别与128种场景类型,从厨房卧室到仓库地面与装配线全面覆盖。
该数据集开放用于学术研究与商业训练,可直接从数据平台获取。如此大规模数据集能在平台上开放发布,始终令人振奋。
更多信息请访问:http://hf.co/collections/LightwheelAI/egosuite-open100k…
EgoSuite-Open100K - LightwheelAI数据集合集
来源:https://huggingface.co/collections/LightwheelAI/egosuite-open100k
LightwheelAI (https://huggingface.co/LightwheelAI) 数据集合集
EgoSuite-Open100K (https://huggingface.co/collections/LightwheelAI/egosuite-open100k)
更新于4天前
全球最大的全标注开放自人类视角数据集。涵盖15,000+任务与场景,共计10万小时数据。
点赞数 27 (https://huggingface.co/login?next=%2Fcollections%2FLightwheelAI%2Fegosuite-open100k)-
-
— #### LightwheelAI/EgoStandard 更新于1天前 • 4.85千次使用 • 22点赞 (https://huggingface.co/datasets/LightwheelAI/EgoStandard)
-
— #### LightwheelAI/EgoPro 更新于1天前 • 6.02千次使用 • 16点赞 (https://huggingface.co/datasets/LightwheelAI/EgoPro)
-
— #### LightwheelAI/EgoDemo 更新于2天前 • 6.28千次使用 • 14点赞 (https://huggingface.co/datasets/LightwheelAI/EgoDemo)
点赞数 27 (https://huggingface.co/login?next=%2Fcollections%2FLightwheelAI%2Fegosuite-open100k)-
相似文章
@seclink:视频里是加速了的,实际上动作慢很多...
Lightwheel AI 和 Hugging Face 已开源 EgoSuite-Open100K,这是目前最大的全标注第一人称视角人类行为数据集,包含 100,000 小时的数据,重点强调物理AI的规模定律。
HumanNet:将以人为本的视频学习扩展至百万小时规模
HumanNet 是一个包含百万小时标注视频的大规模以人为本的视频数据集,旨在训练视觉-语言-动作模型。它证明了以第一人称视角拍摄的人类视频可以有效地替代机器人数据,用于具身智能任务。
@RemiCadene: 哇,这么多开放数据!
LeRobot 发布了最大的开源人形遥操作数据集,并重新编码为 LeRobot 格式,以实现高效流传输并减少存储占用。
@RekaAILabs: CS2-10k 现已在 @huggingface 上发布。60万+ 第一人称游戏视频。1万+ 小时。每帧都配有相应的键盘、鼠标和3D位置数据。
Reka AI Labs 发布了 CS2-10k 大型数据集,包含超过 60 万个第一人称游戏视频,总计超过 1 万小时,每帧都配有键盘、鼠标和 3D 位置数据。该数据集已在 Hugging Face 上开放,可用于世界模型、基于动作的视频生成以及第一人称导航研究。
Ego2Robot:从第一人称人类数据规模化合成机器人数据
Ego2Robot是一个可扩展的流水线,通过动作重定向和视觉合成,将第一人称人类操作视频转换为机器人训练数据,生成涵盖15种机器人形态的18,561小时数据。实验表明,在该合成数据与真实机器人数据上联合预训练,可提升视觉-语言-动作模型在分布外场景下的泛化能力,并已在真实机器人部署中得到验证。