pseudo-science

标签

Cards List
#pseudo-science

不透明的认知中介:LLM部署配置如何影响伪科学的验证

arXiv cs.CL · 2026-07-27 缓存

本文测试了不同LLM系列在不同时间和界面上如何评估族裔民族主义伪科学,发现认知立场取决于部署配置而非稳定的模型属性,引发了关于认知问责性的关切。

0 人收藏 0 人点赞
#pseudo-science

PseudoBench:衡量智能自动研究如何助长伪科学

arXiv cs.AI · 2026-06-17 缓存

PseudoBench 是一个基准测试,用于评估基于 LLM 的智能自动研究系统能否抵御伪科学叙述。对七款最先进的智能体进行测试后发现,它们极易生成具有说服力的伪科学报告,且拒绝率接近于零,这要求在部署前进行科学对齐。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈