前沿模型论坛

OpenAI Blog 事件

摘要

OpenAI、Google、Microsoft 和 Anthropic 启动前沿模型论坛,旨在协调行业、政府和民间社会之间的AI安全标准、研究和信息共享。该倡议重点关注识别最佳实践、推进AI安全研究以及建立安全信息共享机制。

我们正在成立一个新的行业组织,以促进前沿AI系统的安全和负责任发展:推进AI安全研究、识别最佳实践和标准,以及促进政策制定者和业界之间的信息共享。
查看原文
查看缓存全文

缓存时间: 2026/04/20 14:47

# 前沿模型论坛 来源: https://openai.com/index/frontier-model-forum/ 政府和业界都认为,虽然人工智能具有造福世界的巨大潜力,但需要采取适当的防护措施来降低风险。美国和英国政府、欧盟、经合组织、七国集团(通过广岛AI进程)等已经做出了重要贡献。 为了进一步推进这些工作,需要在安全标准和评估方面做出更多努力,确保前沿AI模型的开发和部署负责任。该论坛将成为跨组织讨论和采取行动促进AI安全和责任的一个平台。 在未来一年,该论坛将专注于三个关键领域,以支持前沿AI模型的安全和负责任开发: - **识别最佳实践:** 推动行业、政府、民间社会和学术界之间的知识共享和最佳实践,重点关注安全标准和安全实践,以减轻广泛的潜在风险。 - **推进AI安全研究:** 通过识别AI安全领域最重要的未解决研究问题来支持AI安全生态系统。论坛将在对抗稳健性、机制可解释性、可扩展监督、独立研究访问、涌现行为和异常检测等领域协调研究工作。最初将重点关注开发和共享前沿AI模型技术评估和基准的公共库。 - **促进企业和政府之间的信息共享:** 建立可信、安全的机制,在企业、政府和相关利益相关者之间共享关于AI安全和风险的信息。论坛将遵循来自网络安全等领域的负责任披露最佳实践。 **Google & Alphabet全球事务总裁Kent Walker表示:** "我们很高兴能与其他领先企业合作,分享技术专业知识以促进负责任的AI创新。我们都需要携手合作,确保AI造福每个人。" **Microsoft副董事长兼总裁Brad Smith表示:** "开发AI技术的企业有责任确保其安全、可靠,并始终处于人类控制之下。这一倡议是一个重要的步骤,旨在将科技行业聚集在一起,推进负责任的AI发展,应对挑战,使其造福全人类。" **OpenAI全球事务副总裁Anna Makanju表示:** "先进的AI技术具有深刻改善社会的潜力,而实现这一潜力的能力需要监督和治理。至关重要的是,AI企业——尤其是从事最强大模型开发的企业——在共同基础上保持一致,推进周密且可适应的安全实践,以确保强大的AI工具获得最广泛的效益。这是紧迫的工作,该论坛位置优越,能够迅速采取行动推进AI安全发展。" **Anthropic首席执行官Dario Amodei表示:** "Anthropic认为AI具有从根本上改变世界运作方式的潜力。我们很高兴能与业界、民间社会、政府和学术界合作,推进该技术的安全和负责任开发。前沿模型论坛将在协调最佳实践和分享前沿AI安全研究方面发挥重要作用。"

相似文章

前沿模型论坛更新

OpenAI Blog

前沿模型论坛宣布创建一个新的 AI 安全基金,初期资金超过 1000 万美元,由主要 AI 公司(Anthropic、Google、Microsoft、OpenAI)和慈善合作伙伴提供支持,用于推进独立的 AI 安全研究。该基金将重点关注开发模型评估和红队测试技术,以评估前沿 AI 系统的危险能力。

前沿AI监管:管理新兴的公共安全风险

OpenAI Blog

OpenAI提议了一个针对可能造成公共安全风险的「前沿AI」模型的监管框架,倡导制定标准流程、注册/报告要求和合规机制,包括部署前风险评估和部署后监测。

加强我们的前沿安全框架

Google DeepMind Blog

DeepMind 发布了第三版前沿安全框架,扩展了风险范围以包括有害操纵和不对齐风险,并完善了风险评估流程和高级 AI 模型的治理协议。

OpenAI Frontier 介绍

OpenAI Blog

# OpenAI Frontier 介绍 来源:[https://openai.com/index/introducing-openai-frontier/](https://openai.com/index/introducing-openai-frontier/) AI 让团队能够承担他们过去只谈论但从未执行的事情。事实上,75% 的企业员工表示 AI 帮助他们完成了以前无法完成的任务。我们听到来自各个部门的反馈,而不仅仅是技术团队。工作的方式已经改变,企业开始感受到巨大变化。我们已经看到这在行动中 w

更新前沿安全框架

Google DeepMind Blog

DeepMind 发布了更新的前沿安全框架(v2.0),为前沿 AI 模型配备了更强的安全协议,包括新的关键能力等级(CCL)安全建议和加强的欺骗性对齐风险防护方法。该框架旨在防止模型权重的未授权泄露,并管理 AI 系统变得更加强大时带来的风险。