来自 Blog 的文章
DeepMind为其Private AI Compute架构引入服务器端内存,实现跨设备的持久化AI内存,同时通过加密存储和安全飞地保持设备上的隐私。
Google 推出 Gemini 3.8 Flash TTS 与 Gemini 3.8 Flash-Lite TTS,这些新的文本转语音模型可让创作者和开发者生成富有表现力且可定制的音频。
NVIDIA 发布了 Nemotron 3 Diarization,这是一个开源100M参数模型,实现了最先进的说话人识别,错误率为14.72%,支持最多八名说话人的实时和离线处理。
OpenAI 向乌克兰提供其 Daybreak 计划的访问权限,以加强民用基础设施的网络防御,利用人工智能工具识别和修复漏洞。
这是一则关于10月14日在San Francisco举行的智能体工程BOF会议的公告,旨在通过非正式讨论和与该领域的建设者和实验者进行展示交流。
NVIDIA及其合作伙伴在新加坡AI日展示了AI技术进展,重点涵盖公共部门AI、智能体AI以及东南亚地区的合作项目。
本文探讨了中国经济下滑的现象,重点涉及青年失业和复苏乏力等问题,并将人工智能定位为一个关键的国家支持领域。作者根据北京之行,反思了中美关系的个人和地缘政治层面。
OpenAI CEO Sam Altman和Anthropic CEO Dario Amodei预计将向UN Security Council就AI安全发表讲话,随着对人类风险的担忧和监管呼声日益增强。
GPT-6 Astra 自动破解了一条古老的恩尼格玛消息,通过开发恩尼格玛模拟器和炸弹机,使用一个重复的地名作为已知明文,并成功找到了正确的密钥和明文。
生物计算公司与 AWS 合作,商业化一种神经元衍生 AI 视频模型,该模型利用生物数据优化文本到视频生成,在标准硬件上提供更快更便宜的推理。
CXMT声称其第五代DRAM技术已匹配行业领先者Samsung和Micron,进入量产同时应对美国出口管制。
本文介绍了限制大规模MoE训练中四个关键内存峰值的方法,使得在1M上下文长度下使用固定GPU内存进行训练成为可能,并且相比基线,吞吐量提升高达10.4倍。
vLLM正在引入硬件无关层,以在尖端硬件上的高性能与跨不同加速器的可移植性之间取得平衡,解决与torch.compile的兼容性问题。
Google 介绍了 RRSI,这是一种用于 AI 代理框架中规范化递归自改进的方法,可增强跨基准的迁移学习并减少过拟合。
Vinod Khosla 预测,个人AI的两大护城河是用户对公司的信任以及工具有效完成任务的能力,他指出 Meta 在消费者信任方面存在巨大劣势。
Perplexity 结合了拒绝采样微调与提示引导自蒸馏,以在真实世界工具使用中训练其 Computer 模型,从成功会话和用户纠正的失败中学习。
SWE-Bench Pro V2是一个更新的基准测试,用于在软件工程中评估AI代理,包含来自11个代码库的642个任务,具有改进的评估协议和污染控制。