顶级AI会议使用AI检测器拒绝涉嫌由AI撰写的论文
摘要
NeurIPS 2026使用了专有AI文本检测器,以涉嫌违反AI政策为由直接拒绝论文,但未在目标分布上验证该检测器;随后同一检测器又将会议主席自己的论文标记为可能由AI撰写。
[这篇LinkedIn帖子](https://www.linkedin.com/posts/s-berezin_pangram-assigned-69-ai-generated-probability-ugcPost-7467974774019887105-Hf72/?utm_source=share&utm_medium=member_desktop&rcm=ACoAADmVfPUBg_jGQN0hkmxmj0xCG8dfBfzh0KI)指出,NeurIPS 2026使用了专有AI文本检测器,以涉嫌违反AI政策为由直接拒绝论文,但未在目标分布上验证该检测器。该作者随后将NeurIPS立场论文轨道主席的最新论文输入同一检测器,Pangram为其分配了高AI分数,包括69%、45%、36%和24%的AI概率。
相似文章
为何AI检测在学术诚信中失效
本文评估了学术环境中的商业AI检测器,发现对AI辅助的人类写作存在高误报率,而通过人性化工具(humanizers)几乎可以完全规避检测,因此得出结论:检测分数不应作为不当行为的独立证据。
NeurIPS 使用未校准的 AI 检测器进行桌面拒稿 [D]
一篇投稿因未校准的 AI 检测器(Pangram)而被 NeurIPS 桌面拒稿,引发了对审稿流程循环性以及在目标分布上未经验证的误报率的担忧。
@rohanpaul_ai: AI检测器行业在阅读这份MIT报告时应感到非常不安。最强的机构反对声音……
一份MIT报告强烈建议不要依赖AI检测器,理由包括与AI人性化器的军备竞赛、误报伤害学生、以及对非英语母语者和神经多样性个体的不公平影响。
@rohanpaul_ai: 用户可以利用AI进行润色而不外包思维,但'AI检测器'并不总能识别差异,Semafor…
本文探讨了作者如何使用AI润色作品而不外包思维,以及AI检测器如何常常无法区分AI辅助写作,从而引发法律挑战和伦理辩论。
AI检测器是个糟糕的想法
本文认为,AI检测器和水印技术存在问题,因为它们忽视了作品背后的人类努力,并降低了AI生成文本的质量。