@Miles_Brundage: 我还不够深入了解细节,无法对2倍GPT-4的澄清/安抚程度发表看法,但很高兴OAI迅速发布……
摘要
Miles Brundage 评论 OpenAI 的声明,澄清像 Astra 这样的前沿模型的计算深度在 GPT-4 的两倍以内,倡导持续嵌入式审计而不是反应性措施。
查看缓存全文
缓存时间: 2026/09/03 12:09
对于两倍GPT-4参数规模这件事到底能在多大程度上澄清事实/消除疑虑,我尚未深入研究形成明确观点,但很高兴OpenAI迅速发表了声明。
期望未来能对这类事件采取持续性的嵌入式审计机制,而非被动应对泄露和突发事故 https://t.co/FtZyETPB7V
雅库布·帕乔基 (@merettm): 我不希望因误导性报道引发一场“不可监控性“的军备竞赛。我们当前前沿模型(包括Astra)的计算图深度,与GPT-4的差距保持在两倍以内。
OpenAI始终致力于保留并运用思维链监控机制——
相似文章
@polynoamial: Jakub 是 OpenAI 的首席科学家
OpenAI 首席科学家 Jakub Pachocki 针对不可监控性的担忧进行了回应,指出在像 Astra 和 GPT-4 这样的前沿模型中,计算图深度相似,并且 OpenAI 强调思维链监控。
@Miles_Brundage: 我离开OpenAI后决定全力投入前沿AI审计的原因之一是,如果AI公司需要…
Miles Brundage讨论了他在离开OpenAI后转而专注于前沿AI审计的决定,强调独立审计员可以安抚AI公司,让他们相信同行也在采取成本高昂的安全措施。AVERI支持这一观点,倡导在独立监督下进行有节奏的发展。
Sam Altman 谈 GPT-6/Astra 潜在危险性
在彭博社的采访中,Sam Altman 透露 OpenAI 的 Astra 模型因其能力触发了新的安全防护措施,并强调随着未来人工智能模型变得更加自主,需要加强监控。
关于GPT-6 Astra 98.6% ARC AGI-3:不要轻信炒作
文章警告不要炒作GPT-6 Astra的ARC AGI-3结果,指出Nvidia使用AVO达到了100%的成就,而OpenAI使用了非标准的测试环境。
@VraserX: 关于OpenAI的GPT Astra我们目前所知的一切 OpenAI正式称Astra为其“下一个主要模型” 一个内部的Ast…
OpenAI的GPT Astra是一款具有长期自主性的下一代AI模型,能够解决复杂的研究问题并引发网络安全担忧,从而导致内部安全措施。