human-data

标签

Cards List
#human-data

@seclink:视频里是加速了的,实际上动作慢很多...

X AI KOLs Timeline · 2天前 缓存

Lightwheel AI 和 Hugging Face 已开源 EgoSuite-Open100K,这是目前最大的全标注第一人称视角人类行为数据集,包含 100,000 小时的数据,重点强调物理AI的规模定律。

0 人收藏 0 人点赞
#human-data

@KimD0ing:征文启事:Scaling H2R @ CoRL 2026——人类数据已成为机器人学习最重要的数据。但随着其规模扩大,我们能期待什么?……

X AI KOLs Timeline · 2026-08-09 缓存

CoRL 2026 上 Scaling H2R 研讨会的征文启事,聚焦于人类到机器人学习中的规模法则与多样性。提交截止日期:2026年10月7日。

0 人收藏 0 人点赞
#human-data

Reddit用户是否应该关注他们的帖子如何被用于训练AI?

Reddit r/artificial · 2026-07-03 缓存

本文认为,随着网络充斥着合成内容,Reddit上混乱但真实的人类对话对于训练AI正变得越来越有价值,凸显了经济向稀缺人类行为数据的转变。

0 人收藏 0 人点赞
#human-data

在LLM个性化中重新聚焦人类

arXiv cs.CL · 2026-06-08 缓存

本文研究了在评估LLM个性化的三个阶段(属性提取、相关性匹配和响应生成)中,合成数据与人类数据之间的差距。结果表明,模型在真实人类数据上表现更差,作者引入了轻量级训练干预措施以改善对齐。

0 人收藏 0 人点赞
#human-data

@Datou: 微软还是爱惜羽毛的,刻意避开合成数据,只用人类数据训练出一个 base 模型,然后一生三,训练三个不同领域的专家模型,然后自己蒸馏自己,把三种能力蒸回 bese 模型(权重配比很考验经验),再强化学习一轮让蒸馏模型懂得看问题下菜碟灵活运用…

X AI KOLs Timeline · 2026-06-02 缓存

微软发布MAI-Thinking-1训练技术细节:使用纯人类数据训练基座模型,然后训练三个领域专家模型,通过蒸馏将能力合并回基底模型,再经强化学习使模型能灵活运用不同能力。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈