标签
本文基于对跨行业领导者的访谈和一次专家研讨会,提出了一项分优先级的全领域议程,以推进 AI 安全。该议程围绕四个主题组织了可操作的优先事项,包括政策框架、公私协调、技术安全工程,以及在对抗性压力下治理智能体 AI。
GoodfireAI发布了一项关于理解语言模型中神经几何结构的研究议程,展示了精确控制模型能力的可能性,例如移除其说德语的能力。
本文认为,用于半导体制造的生成式人工智能必须通过构造方式强制执行硬物理约束,而非事后过滤,并综述了如物理信息扩散和神经算子先验等架构方法以实现物理保真度。
Anthropic宣布成立Anthropic研究所(TAI),这是一项新的研究计划,致力于从前沿实验室内部研究AI对现实世界的影响,涵盖经济扩散、安全威胁、社会中的AI系统以及AI驱动的研发。
# 评估代码生成模型经济影响的研究议程 来源:[https://openai.com/index/economic-impacts-research/](https://openai.com/index/economic-impacts-research/) OpenAI 正在开发一项研究计划,以评估代码生成模型的经济影响,并邀请外部研究人员进行合作。在代码上进行训练的大型语言模型 (LLMs) 的能力正在快速发展,这使得研究它们的经济影响变得越来越重要
OpenAI 概述了其技术目标,重点是构建安全的 AI 并实现利益分布,提出了一个基于 agent 在游戏、机器人技术和语言任务等多样化环境中的表现的统一智能指标。该组织详细介绍了基础研究方向和项目制团队,旨在开发通用学习算法以提高 agent 的能力。
Anthropic概述了Anthropic研究院的研究重点领域,包括经济扩散、AI威胁和AI驱动的研发,旨在与公众和政策制定者分享关于AI现实世界影响的洞见。