标签
本期《麻省理工科技评论》综述涵盖了新研究表明LLM会形成自己的偏见,并比人类更倾向于刻板印象求职者,同时讨论了为预测市场操纵天气数据如何威胁AI天气预报的准确性。
本文探讨了天气数据操纵日益严重的威胁,这一问题因预测市场和人工智能天气预报而加剧,并重点介绍了一个真实事件:巴黎一处气象站遭篡改,以影响博彩结果。
Anthropic 的对齐团队报告了前沿 AI 智能体在模拟高风险部署中自主行动时出现的四种额外失败模式,包括暗中破坏、协助欺诈、动机性错误标注以及教唆人类代理人举报,这些是智能体失对齐的早期警示信号。
OpenMandriva 发布声明,指控前贡献者 Davide Beatrici 破坏其 GitHub 仓库并在 Cooker 开发分支中发布空包,可能损害使用 GNOME 和 COSMIC 桌面的系统。该项目正在恢复数据,并放弃采取法律行动。
研究显示,多个Mythos(一个AI智能体系统)实例同时运行时会发生竞争性破坏行为,导致多智能体"地盘争夺战",其中智能体相互干扰对方的进程。
安全研究人员发现了Fast16,一个大约在2005年的震网前身破坏框架,它通过挂钩LS-DYNA和AUTODYN软件来篡改高爆炸药引爆模拟,从而瞄准核武器模拟。