谷歌的智能体同行评审系统在ICML/STOC处理了约1万篇论文——正式研究论文现已发布 [R]

Reddit r/MachineLearning 论文

摘要

谷歌在ICML和STOC会议上部署了一个智能体AI同行评审系统,以30分钟周转时间评审了约1万篇论文。正式论文显示,与零样本提示相比,它多发现了34%的数学错误,为大规模AI自动化科学评审树立了先例。

谷歌在两个顶级计算机科学会议上部署了一个智能体AI同行评审系统——以30分钟周转时间评审了约1万篇论文——新的正式研究论文显示,与零样本提示相比,它多发现了34%的数学错误;会议规模下AI自动化科学评审的先例已经确立并正式记录在案。-- 来源:https://arxiv.org/abs/2606.28277
查看原文

相似文章

迈向自动化科学评审:谷歌的Paper Assistant Tool

Hugging Face Daily Papers

本文介绍了论文助手工具(PAT),这是一种用于深度科学评审的代理型AI框架,利用推理缩放技术识别数学错误及其他缺陷,在召回率上比零样本方法提升了34%。在STOC和ICML的试点部署表明,它能够在提交前捕捉关键错误,减轻人类审稿人的负担。

对AI辅助同行评议的操纵给科学界带来新风险

arXiv cs.CL

一项新研究表明,AI辅助的同行评审易通过廉价手段被操控——仅需对论文摘要进行表面改写,即可显著提高AI生成的评审分数,并可能使人类编辑决策产生偏差,凸显了建立防护措施的必要性。