标签
本文介绍了Skilder,一个将能力打包成角色以提供LLM代理访问控制的框架,确保确定性治理并提高工具使用系统的安全性。
SAFi 是一个即将发布的免费开源治理系统,专为受监管行业的AI代理设计,旨在轻松部署为完整设备,无需额外开发工具。
本文讨论了构建无代码AI代理的便利性,并提出了关于在生产环境中实施防护措施和治理以防止错误的问题。
论文回顾了基于LLM的可信代理AI系统的故障模式和缓解策略,并介绍了可信代理开发生命周期(TADL)框架,用于安全开发。
Massachusetts 州长强调需要在AI安全方面迅速采取行动,敦促在州一级建立强有力的保护措施,并呼吁华盛顿实施类似措施。
扎克伯格主张AI实验室应自主负责安全事务,并以Meta推迟Muse项目为例证明其有效性,同时引发了关于AI智能体部署及治理必要性的讨论。
本文探讨了AI安全辩论,质疑其是否真正关注安全还是控制,并强调了像Dario Amodei和Mark Zuckerberg等高管关于行业自律与政府监督的观点。
Opal Zero 是一个AI驱动的访问治理平台,它为AI代理提供即时、任务范围的访问权限,以缓解团队扩展时的许可瓶颈。
这份欧盟专家报告认为,AI已经在工作、医疗保健和媒体等领域影响社会,强调需要跨学科治理和公共利益设计,以确保利益广泛分布并减轻风险。
SAGE是一个受控的多阶段大语言模型流水线,可自动化将企业指南文档转换为结构化制品,将手动工作时间从数天缩短至数分钟,成功率达96%,且幻觉率低。
Google DeepMind 推出 DeepMind 研究所,旨在通过跨学科研究解决 AGI 的技术和社会影响,涵盖安全性、治理和人类价值观。
本叙事综述审视了LLM赋能GeoAI中的伦理与隐私风险,识别关键问题,并提出一个具有可执行控制的治理感知架构。
本文综述了人工智能在生物学研究中的能力及其相关的生物安全风险,倡导采用纵深防御治理来减轻威胁,同时保留有益用途。
本文倡导强有力的举报人保护措施以应对AI风险,并强调在AI对齐和安全方面进行严肃投资,以抵御AI赋能的国家级攻击者。
OpenController by lyzr 是一个统一控制平面,用于管理多平台上的AI代理,提供部署、实时监控和策略执行功能。