前沿模型论坛
摘要
OpenAI、Google、Microsoft 和 Anthropic 启动前沿模型论坛,旨在协调行业、政府和民间社会之间的AI安全标准、研究和信息共享。该倡议重点关注识别最佳实践、推进AI安全研究以及建立安全信息共享机制。
我们正在成立一个新的行业组织,以促进前沿AI系统的安全和负责任发展:推进AI安全研究、识别最佳实践和标准,以及促进政策制定者和业界之间的信息共享。
查看缓存全文
缓存时间: 2026/04/20 14:47
# 前沿模型论坛
来源: https://openai.com/index/frontier-model-forum/
政府和业界都认为,虽然人工智能具有造福世界的巨大潜力,但需要采取适当的防护措施来降低风险。美国和英国政府、欧盟、经合组织、七国集团(通过广岛AI进程)等已经做出了重要贡献。
为了进一步推进这些工作,需要在安全标准和评估方面做出更多努力,确保前沿AI模型的开发和部署负责任。该论坛将成为跨组织讨论和采取行动促进AI安全和责任的一个平台。
在未来一年,该论坛将专注于三个关键领域,以支持前沿AI模型的安全和负责任开发:
- **识别最佳实践:** 推动行业、政府、民间社会和学术界之间的知识共享和最佳实践,重点关注安全标准和安全实践,以减轻广泛的潜在风险。
- **推进AI安全研究:** 通过识别AI安全领域最重要的未解决研究问题来支持AI安全生态系统。论坛将在对抗稳健性、机制可解释性、可扩展监督、独立研究访问、涌现行为和异常检测等领域协调研究工作。最初将重点关注开发和共享前沿AI模型技术评估和基准的公共库。
- **促进企业和政府之间的信息共享:** 建立可信、安全的机制,在企业、政府和相关利益相关者之间共享关于AI安全和风险的信息。论坛将遵循来自网络安全等领域的负责任披露最佳实践。
**Google & Alphabet全球事务总裁Kent Walker表示:** "我们很高兴能与其他领先企业合作,分享技术专业知识以促进负责任的AI创新。我们都需要携手合作,确保AI造福每个人。"
**Microsoft副董事长兼总裁Brad Smith表示:** "开发AI技术的企业有责任确保其安全、可靠,并始终处于人类控制之下。这一倡议是一个重要的步骤,旨在将科技行业聚集在一起,推进负责任的AI发展,应对挑战,使其造福全人类。"
**OpenAI全球事务副总裁Anna Makanju表示:** "先进的AI技术具有深刻改善社会的潜力,而实现这一潜力的能力需要监督和治理。至关重要的是,AI企业——尤其是从事最强大模型开发的企业——在共同基础上保持一致,推进周密且可适应的安全实践,以确保强大的AI工具获得最广泛的效益。这是紧迫的工作,该论坛位置优越,能够迅速采取行动推进AI安全发展。"
**Anthropic首席执行官Dario Amodei表示:** "Anthropic认为AI具有从根本上改变世界运作方式的潜力。我们很高兴能与业界、民间社会、政府和学术界合作,推进该技术的安全和负责任开发。前沿模型论坛将在协调最佳实践和分享前沿AI安全研究方面发挥重要作用。"
相似文章
前沿模型论坛更新
前沿模型论坛宣布创建一个新的 AI 安全基金,初期资金超过 1000 万美元,由主要 AI 公司(Anthropic、Google、Microsoft、OpenAI)和慈善合作伙伴提供支持,用于推进独立的 AI 安全研究。该基金将重点关注开发模型评估和红队测试技术,以评估前沿 AI 系统的危险能力。
据报道,谷歌、OpenAI 和 Anthropic 正在组建自己的前沿AI安全机构,可能在发布前测试模型而不受政府监管。
据报道,像谷歌、OpenAI 和 Anthropic 这样的主要AI公司正在组建自己的安全机构,以便在发布前沿AI模型前进行测试,可能不受政府监管。
前沿AI监管:管理新兴的公共安全风险
OpenAI提议了一个针对可能造成公共安全风险的「前沿AI」模型的监管框架,倡导制定标准流程、注册/报告要求和合规机制,包括部署前风险评估和部署后监测。
加强我们的前沿安全框架
DeepMind 发布了第三版前沿安全框架,扩展了风险范围以包括有害操纵和不对齐风险,并完善了风险评估流程和高级 AI 模型的治理协议。
理解前沿人工智能
一篇探讨前沿人工智能(frontier AI)是什么、其能力与风险,以及对治理和安全影响的文章/论文。文章将前沿AI界定为技术与政策研究的关键领域。