所有主要机器人学与VLA论文,统一排名与基准评测 [P]
摘要
Papers with Code新推出的机器人学专属页面,汇集了主要基准评测、带代码链接的热门论文以及开源成果,并持续追踪LIBERO、SimplerEnv等基准的进展。
大家好,
Papers with Code现在有了专门的机器人学页面,列出了主要基准评测、带代码链接的热门论文以及开源成果。访问地址:https://paperswithcode.co/tasks/robotics https://preview.redd.it/wvhcgu1q1fdh1.png?width=3034&format=png&auto=webp&s=9a43021f7b8e1b840b09f55bb8aee0c4b2d54215
多数论文报告评测的主要基准包括:
- LIBERO及其子集如LIBERO-Long和LIBERO-Spatial
- SimplerEnv WidowX
- RoboTwin等。
目前每个基准约有110条记录。各基准的进展随时间可视化如下:
https://preview.redd.it/myl3ysvv2fdh1.png?width=2880&format=png&auto=webp&s=3fae2b73d592f2c7ddd3118ec2c5a0d5c5e93b65
我们还标注了哪些模型是开源的,哪些不是。如有遗漏,请告知,我很乐意补充。也非常欢迎任何反馈、新任务或功能建议!
此致
Niels
ML工程师@HF
相似文章
@lucas_flatwhite: 对于关注人工智能研究/智能体趋势的各位,请务必收藏此页面..! Papers with Code https://paperswithco…
Papers with Code 是一个专注于人工智能研究论文与代码的平台,在被 Meta 收购后,由 Hugging Face 从头重建,为研究、代码实现以及特定任务的排行榜提供了统一入口。
PRL-Bench:评估大语言模型在尖端物理研究中能力的全面基准
PRL-Bench是一个全面基准,用于评估大语言模型在尖端物理研究中的能力,基于从五个物理子领域精选的100篇《物理评论快报》论文构建。该基准揭示了当前大语言模型性能的重大差距(最佳得分低于50%),旨在测试端到端研究流程、复杂推理和自主探索。
@VincentLogic: 每天被 Arxiv 的新论文淹没?头都大了。 刚发现一个宝藏网站,专门聚合最新的 AI 论文和模型基准测试(Benchmarks)。 界面很干净,直接看 Trending 或者按周/月筛选。最爽的是每篇论文都直接关联了它用到的 bench…
推荐一个免费网站 sophon.at/papers,聚合最新 AI 论文和模型基准测试,界面干净,支持按 Trending 或周/月筛选,每篇论文直接关联所用 benchmark 和 model。
在Papers with Code一站式寻找最佳开源OCR模型 [P]
Papers with Code上的一个精选页面列出了顶级开源OCR模型和基准测试,重点介绍了百度(Unlimited OCR)和Mistral(OCR 4)的新发布,旨在支持RAG等AI智能体应用场景。
复兴PapersWithCode(由Hugging Face开发)[P]
来自Hugging Face的Niels宣布复兴PapersWithCode,新平台为paperswithcode.co,能够大规模解析高影响力的AI论文,并自动生成排行榜和基准测试,融合了热门论文、领域分类以及外部论文支持等功能。