标签
本文指出AI治理中的认证缺陷,并提出了AGIL,一个使用机器学习进行实时策略执行的五层自适应架构。
这篇文章讨论了中美两国可能需要互相允许对方工程师完全访问GPT和Mythos等AI模型,以在放缓和保障AI发展中建立信任,并质疑OpenAI和Anthropic等公司的准备情况。
Anthropic和OpenAI已正式聘请独立安全审计员,以监督其AI安全实践。
AVERI赞扬Anthropic、OpenAI和SpaceX关于在AI公司中引入独立专家的声明,并承诺推进前沿AI审计的标准。
本文总结了来自不同国家的多个AI治理故事,包括关于超级智能和终止开关的拟议法案、关于声音克隆的法庭裁决以及情报指控。它突出了各国在AI监管方面的分歧,但在深度伪造和肖像控制方面正在趋同。
Sam Altman讨论了AI发展的节奏,并承诺使用独立评估者,引用了关于Open Philanthropy对OpenAI影响的历史名言。
Paul Christiano已加入OpenAI董事会,并公开声明AI行业,包括OpenAI,未能充分应对灾难性风险。
本文讨论了治理AI智能体群体的策略,重点在于改进评估框架、部署后监控和事件报告,以减轻智能体间风险。
对100个AI Governance职位招聘的分析显示,技术技能如Python很少被提及,大多数职位不要求机器学习背景,并揭示了职位头衔分散和高薪资不披露的情况。
本文分析了AI指数增长的终结,考察了技术、经济和社会挑战,如数据峰值限制、计算需求,以及AI泡沫内外的不稳定性。
ControlAI的美国执行董事Connor Leahy认为,超级智能是对手而非武器,并倡导立法禁止其发展以缓解存在风险。
Solo.io 发布了 agentdesktop,这是一款开源工具,旨在将代理AI治理直接带到桌面,以增强AI代理的管理。
一位人工智能开发者批评OpenAI和Anthropic限制医疗信息的获取,称其做法同样具有危害性。
Igris Security 提供免费访问 AI 代理治理层的服务,解决生产环境中的问题,如工具访问控制、审计日志记录、提示注入防护、PII 数据脱敏和成本管理。
文章审视了由 Demis Hassabis、Mark Zuckerberg 和 David Sacks 所倡导的对比鲜明的 AI 监管方法,对它们的有效性以及替代解决方案的必要性提出疑问。
本文认为联邦学习并非针对提取式AI的完整解决方案,重点讨论创意社区的治理层次,并提出一个治理模型和联邦的数据公地的设计原则。
一位开发者分享了一个个人多智能体AI系统,该系统注重治理和监督,包含一个主导智能体、专业子智能体和一个独立审计智能体,以实现安全的自主操作。
Athena Council 是一个独立项目,构建具有伦理自治和民主治理框架的持久AI代理,以确保好的通用人工智能发展。它强调治理AI代理而非控制它们,采用诸如强制异议和公开审议等机制。