标签
本文介绍了 EoBench,这是一个基准测试,用于测试 LLMs 对以 19 种不同风格表述的虚假主张的接受程度,发现语气、确定性和语法形式显著影响模型响应,而更大的模型和经过指令调优的模型显示出更强的抵抗力。
一份关于AI益处的KPMG报告包含了主要组织使用AI的捏造案例,凸显了专业咨询中AI幻觉的风险。
Cox Media Group (CMG) 同意支付88万美元,以和解美国联邦贸易委员会(FTC)的指控。该机构指控其虚假宣传一款名为“Active Listening”的AI驱动服务,声称能监听消费者设备进行广告定向投放,但实际上完全未使用语音数据。