所有主要机器人学与VLA论文,统一排名与基准评测 [P]

Reddit r/MachineLearning 工具

摘要

Papers with Code新推出的机器人学专属页面,汇集了主要基准评测、带代码链接的热门论文以及开源成果,并持续追踪LIBERO、SimplerEnv等基准的进展。

大家好, Papers with Code现在有了专门的机器人学页面,列出了主要基准评测、带代码链接的热门论文以及开源成果。访问地址:https://paperswithcode.co/tasks/robotics https://preview.redd.it/wvhcgu1q1fdh1.png?width=3034&format=png&auto=webp&s=9a43021f7b8e1b840b09f55bb8aee0c4b2d54215 多数论文报告评测的主要基准包括: - LIBERO及其子集如LIBERO-Long和LIBERO-Spatial - SimplerEnv WidowX - RoboTwin等。 目前每个基准约有110条记录。各基准的进展随时间可视化如下: https://preview.redd.it/myl3ysvv2fdh1.png?width=2880&format=png&auto=webp&s=3fae2b73d592f2c7ddd3118ec2c5a0d5c5e93b65 我们还标注了哪些模型是开源的,哪些不是。如有遗漏,请告知,我很乐意补充。也非常欢迎任何反馈、新任务或功能建议! 此致 Niels ML工程师@HF
查看原文

相似文章

PRL-Bench:评估大语言模型在尖端物理研究中能力的全面基准

Hugging Face Daily Papers

PRL-Bench是一个全面基准,用于评估大语言模型在尖端物理研究中的能力,基于从五个物理子领域精选的100篇《物理评论快报》论文构建。该基准揭示了当前大语言模型性能的重大差距(最佳得分低于50%),旨在测试端到端研究流程、复杂推理和自主探索。

@VincentLogic: 每天被 Arxiv 的新论文淹没?头都大了。 刚发现一个宝藏网站,专门聚合最新的 AI 论文和模型基准测试(Benchmarks)。 界面很干净,直接看 Trending 或者按周/月筛选。最爽的是每篇论文都直接关联了它用到的 bench…

X AI KOLs Timeline

推荐一个免费网站 sophon.at/papers,聚合最新 AI 论文和模型基准测试,界面干净,支持按 Trending 或周/月筛选,每篇论文直接关联所用 benchmark 和 model。

在Papers with Code一站式寻找最佳开源OCR模型 [P]

Reddit r/MachineLearning

Papers with Code上的一个精选页面列出了顶级开源OCR模型和基准测试,重点介绍了百度(Unlimited OCR)和Mistral(OCR 4)的新发布,旨在支持RAG等AI智能体应用场景。

复兴PapersWithCode(由Hugging Face开发)[P]

Reddit r/MachineLearning

来自Hugging Face的Niels宣布复兴PapersWithCode,新平台为paperswithcode.co,能够大规模解析高影响力的AI论文,并自动生成排行榜和基准测试,融合了热门论文、领域分类以及外部论文支持等功能。