Evan Hubinger, Anthropic 对齐科学负责人
摘要
Evan Hubinger 被任命为 Anthropic 的对齐科学负责人,标志着在推进人工智能安全研究方面的重要角色。
暂无内容
相似文章
[Anthropic 对齐科学负责人] Evan Hubinger : "....我们真的真诚地相信AI可能杀死所有人类!我个人认为在未来十年内概率超过10%......我们还没有解决超级智能对齐的计划,而且明显不在正轨上。"
Evan Hubinger,Anthropic的对齐科学负责人,表示他相信AI在未来十年内杀死所有人类的概率超过10%,并且Anthropic缺乏解决超级智能对齐的计划。
对齐(Alignment)
本文概述了Anthropic对齐团队的使命与研究重点,该团队通过评估、监督和压力测试等手段开发保障措施,以确保未来的AI系统始终保持有益、诚实和无害。
Anthropic的自动化对齐研究人员表现显著优于人类研究人员
Anthropic宣布其自动化对齐研究系统超越人类研究人员,标志着AI安全与效率的重大进步。
AI安全与对齐
文章讨论了对AI安全与对齐的担忧,随着AI变得更智能并融入社会,文章引用了Anthropic呼吁暂停以应对潜在的灾难性风险。
Anthropic
Anthropic,这家专注于AI安全与研究的公司,近日成为新闻焦点。