标签
本文提出了一种云原生的RAG架构,用于在IBM LinuxONE上实现安全、高通量的企业AI推理,使用Spyre加速器实现低于两秒的延迟,与离平台解决方案相比,性能提升20倍。
本文比较了Privatemode、Tinfoil、NEAR AI和Chutes的机密推理API,重点介绍了它们的安全功能,如端到端加密和可信执行环境,以及在模型选择和验证成熟度方面的权衡。
NVIDIA与HPE正在扩展其AI工厂合作,推出用于智能体AI的NVIDIA Vera CPU、用于HPE Private Cloud AI的NVIDIA Agent Toolkit,以及在整个产品组合中部署NVIDIA机密计算,助力企业将智能体AI投入生产。
NVIDIA的机密计算技术采用Blackwell GPU,已被苹果用于将其私有云计算扩展到Google Cloud,从而在保持强大隐私保护的同时,为Apple Intelligence功能提供安全的服务器端推理。
苹果宣布其私有云计算架构现已扩展到第三方硬件,具体来说是Google的服务器,利用Nvidia、Intel和Google的安全技术来为AFM 3 Cloud Pro等高级AI模型维持隐私保障。
一种新型软件攻击通过误配置Infinity Fabric来破坏AMD SEV-SNP的安全保证,使恶意虚拟机监视器能够对机密虚拟机进行任意读写访问。
本文介绍了 Kettle,一种经认证的构建系统,利用可信执行环境(TEE)生成加密可验证的软件溯源信息。它旨在通过将溯源文档直接与硬件签名的认证报告绑定,消除构建基础设施和操作人员对信任模型的影响。