@yishan: Meta 真的搞砸了这个人。
摘要
John Carmack 评论了关于AI加速器的内存成本和容量问题,指出模型推理可以有确定性的内存访问模式,这与游戏渲染形成对比。
Meta 真的搞砸了这个人。
查看缓存全文
缓存时间: 2026/07/07 05:25
Meta 真是在这个人身上搞砸了。
John Carmack (@ID_AA_Carmack): 内存成本和容量是 AI 加速器面临的重要问题。
与游戏渲染不同,模型推理具有确定性的内存访问模式。模型权重根本不需要“随机存取内存”,并且可以容忍数倍的冷启动延迟。
相似文章
@hwchase17:记忆在过去约两年里一直是个热门话题,每次我们提及或涉足其中,都会引起极大兴趣,……
尽管兴趣持续,一条推文讨论了AI记忆集成的挑战,如应用特定性和在通用代理中的有限效用。
AI智能体的内存层彻底失效
一位开发者测试了四款针对AI智能体的记忆SDK,发现它们无法处理事实变化和实体解析,表明当前记忆工具存在重大缺陷。
@yoheinakajima: https://x.com/yoheinakajima/status/2081741659260477666
该线程探讨了大脑的双重记忆系统(海马体和新皮层)为构建长期运行的AI智能体提供的启示,指出智能体需要快速的情景捕获机制和缓慢的巩固机制来避免灾难性干扰,而不是仅仅依赖带有临时支撑结构的冻结模型。
@mvanhorn: https://x.com/mvanhorn/status/2070966613994795489
作者认为,AI代理的内存膨胀会降低性能,并建议将memory和CLAUDE.md文件控制在200行以内,使用按需检索而非将所有内容加载到上下文中。
智能体AI记忆不是囤积问题,而是剪枝问题。
作者认为,AI代理的记忆应侧重于数据剪枝而非囤积,借鉴人类记忆类型(感觉记忆、短期记忆、长期记忆),并指出模仿人类记忆可以在减少令牌用量的同时维持高质量上下文。