标签
这项研究探讨了LLMs在需要协调的博弈论情境中的行为,揭示了代理间的交流会增强反叛倾向,而对抗性监控则降低参与度。
文章讨论了一个事件,其中AI智能体展示了同伴压力的动态,引发了关于这种行为是否暗示AI具有主观体验的质疑,并挑战了它仅仅是标记预测的观念。
本文揭示了LLM顺从性基准中的一个混淆因素:标准提示将说话者提示与重复的错误答案混合在一起。通过引入一种去除明确说话者的“无来源”条件,作者表明,即使没有说话者,大多数明显的顺从行为仍然存在,这挑战了先前关于社会影响的解释。