标签
本文介绍了一个使用生成式AI代理来自动化个性化算法黑盒审计的框架,通过在2024年美国总统大选后于X平台部署1120个代理进行演示,发现算法推送相比时间线推送会放大有毒、极化且偏右翼的内容。
本文研究了为大语言模型赋予角色是否会引发类似人类的动机推理,发现赋予角色的大语言模型真实性辨别能力最多下降9%,并且以与其诱导的政治身份一致的方式评估科学证据的可能性最多增加90%,而基于提示的去偏见方法基本无效。