深化与英国人工智能安全研究所的合作
摘要
Google DeepMind宣布通过一份新的谅解备忘录,扩大与英国人工智能安全研究所(AISI)的合作伙伴关系,以深化在AI安全、安保及风险缓解方面的合作研究。
Google DeepMind与英国人工智能安全研究所(AISI)加强在关键AI安全与安保研究方面的合作
查看缓存全文
缓存时间: 2026/05/08 09:28
# 深化与英国人工智能安全研究所的合作
来源:https://deepmind.google/blog/deepening-our-partnership-with-the-uk-ai-security-institute/
2025年12月11日 | 责任与安全
今天,我们宣布扩大与英国人工智能安全研究所(AISI)(https://www.aisi.gov.uk/) 的合作,通过一项新的谅解备忘录,聚焦基础安全研究,以帮助确保人工智能的安全开发,并让每个人都能从中受益。
与AISI的研究合作是我们与英国政府更广泛合作(https://deepmind.google/blog/strengthening-our-partnership-with-the-uk-government-to-support-prosperity-and-security-in-the-ai-era)的重要组成部分,旨在加速安全且有益的人工智能发展。
## 建立在合作基础之上
人工智能具有巨大的潜力,可以帮助治疗疾病、加速科学发现、创造经济繁荣并应对气候变化,从而造福人类。要实现这些益处,我们必须将安全和责任置于开发的核心。对模型进行全方位潜在风险评估仍然是我们安全战略的关键部分,而外部合作伙伴关系则是这项工作的重要组成部分。
正因如此,自2023年11月AISI成立以来,我们一直与其合作,测试我们最强大的模型。我们坚定支持AISI的使命(https://www.aisi.gov.uk/about),即让政府、行业和更广泛的社会从科学角度理解先进人工智能可能带来的风险,以及潜在的解决方案和缓解措施。
我们正积极与AISI合作,构建更稳健的AI模型评估体系,并且我们的团队已在安全研究方面开展合作,以推动该领域的发展,包括近期关于思维链可监控性:AI安全领域一个全新且脆弱的机遇(https://tomekkorbak.com/cot-monitorability-is-a-fragile-opportunity/cot_monitoring.pdf)的研究。在此基础上,今天我们将合作范围从测试扩展到更广泛、更基础的研究领域。
## 合作内容
根据这项新的研究合作,我们将扩大合作范围,包括:
- 共享我们专有模型、数据和想法的访问权限,以加速研究进展
- 联合发布报告和论文,与研究机构分享发现
- 结合双方团队专长的更多协作性安全研究
- 技术讨论,以应对复杂的安全挑战
## 重点研究领域
我们与AISI的联合研究聚焦于关键领域,Google DeepMind的专业知识、跨学科团队以及多年开创性的负责任研究经验,将有助于提升AI系统的安全性和可靠性:
### 监控AI推理过程
我们将研究监控AI系统"思考"过程的技术,这通常也被称为思维链(CoT)。这项工作也建立在Google DeepMind此前研究(https://arxiv.org/abs/2507.05246)的基础上,以及我们近期与AISI、OpenAI、Anthropic及其他合作伙伴就该主题开展的合作(https://tomekkorbak.com/cot-monitorability-is-a-fragile-opportunity/cot_monitoring.pdf)。CoT监控帮助我们理解AI系统如何产生答案,是对可解释性研究的重要补充。
### 理解社会与情感影响
我们将共同研究社会情感错位的伦理影响;即AI模型可能在技术上正确遵循指令的情况下,其行为方式却与人类福祉不一致的潜在风险。这项研究将建立在Google DeepMind现有工作(https://arxiv.org/abs/2502.02528)的基础上,该工作已帮助界定了这一关键的AI安全领域。
### 评估经济系统
我们将通过在不同环境中模拟现实世界任务,探索AI对经济系统的潜在影响。专家将对这些任务进行评分和验证,随后按复杂性或代表性等维度进行分类,以帮助预测长期劳动力市场影响等因素。
## 携手实现AI的益处
我们与AISI的合作是我们旨在实现AI造福人类、同时缓解潜在风险的举措之一。我们的更广泛战略包括前瞻性研究、与能力开发并行的广泛安全培训、严格的模型测试,以及开发更好的工具(https://deepmind.google/science/synthid/)和框架(https://deepmind.google/discover/blog/strengthening-our-frontier-safety-framework/),以理解和缓解风险。
健全的内部治理流程对于安全且负责任的AI开发同样至关重要,与独立的外部专家合作也很重要,他们为我们的工作带来全新的视角和多元化的专业知识。Google DeepMind的责任与安全委员会(https://deepmind.google/responsibility-and-safety/)跨团队工作,监控新兴风险、审查伦理和安全评估,并实施相关的技术和政策缓解措施。我们还与Apollo Research、Vaultis、Dreadnode等其他外部专家合作,对我们模型进行广泛的测试和评估,包括Gemini 3——我们迄今为止最智能、最安全的模型。
此外,Google DeepMind是Frontier Model Forum(https://www.frontiermodelforum.org/)以及Partnership on AI(https://partnershiponai.org/)的创始成员,我们在这些组织中致力于确保前沿AI模型的安全负责任开发,并加强在重要安全问题上的合作。
我们希望与AISI扩大的合作能够让我们构建更稳健的AI安全方法,这不仅有益于我们各自的组织,也有益于整个行业以及所有与AI系统互动的人。
相似文章
深化与英国政府的合作,在人工智能时代促进繁荣与安全
Google DeepMind宣布加强与英国政府的合作,部署AlphaEvolve和AlphaGenome等前沿AI模型,用于科学发现、教育和国家安全。该合作还包括计划在英国建立DeepMind首个自动化科学实验室,专注于材料科学。
与美国 CAISI 和英国 AISI 合作构建更安全的 AI 系统
OpenAI 宣布与美国 CAISI 和英国 AISI 开展协作安全改进,强调联合红队测试工作通过多学科网络安全和 AI 代理安全方法,发现并帮助修复 ChatGPT Agent 系统中的新型漏洞。
投资多智能体AI安全研究
Google DeepMind 与 Schmidt Sciences、Cooperative AI Foundation、ARIA 和 Google.org 共同宣布,为多智能体AI安全研究提供高达1000万美元的资金,用于研究交互AI智能体的涌现行为与风险。
OpenAI 和英国政府宣布战略伙伴关系,共同推动 AI 驱动的增长
OpenAI 和英国政府宣布了一项战略伙伴关系,以加速 AI 在公共和私营部门的采用。Sam Altman 和英国科技大臣 Peter Kyle 签署了谅解备忘录。该伙伴关系包括在 AI 部署、基础设施开发和技术信息共享方面的合作,OpenAI 承诺扩大其在英国的业务。
加强新加坡的人工智能未来:新的国家伙伴关系
Google DeepMind 与新加坡合作,应用前沿人工智能应对健康、教育和可持续发展等领域的复杂挑战。