标签
AMD与Anthropic签署了一项价值数百亿美元的AI服务器协议。Anthropic将从明年上半年开始采购高达2吉瓦的AMD Instinct MI450芯片,而AMD将根据部署里程碑向Anthropic投资高达50亿美元。
AMD AI DevMaster黑客马拉松于2026年7月10日至8月6日举行,设有三个赛道(多模态AI、智能体AI、物理AI)和30,000美元奖金池,PyTorch作为ROCm支持的AMD GPU上的官方框架。
一篇博客文章,通过HipKittens论文的视角探索并行编程概念,重点介绍了AMD GPU上重叠计算与内存移动的八波乒乓调度,并与禅宗原则进行了哲学类比。
作为合作的一部分,AMD将向Anthropic投资高达50亿美元,Anthropic将部署AMD的Instinct MI450 GPU用于AI基础设施。两家公司还计划利用Anthropic的Claude模型进行多年工程合作。
Anthropic和AMD达成了一项价值数百亿美元的协议:Anthropic将购买多达2吉瓦的AMD AI芯片,而AMD将向Anthropic投资高达50亿美元。
PyTorch Foundation CTO Matt White将在AMD的AdvancingAI活动上发表演讲,探讨如何使用vLLM和SGLang等开源工具优化AI推理经济学,倡导使用规模合适的模型和智能路由,以改善每美元智能。
AMD Ryzen 7 7700X3D 处理器评测,重点介绍其 3D V-Cache 技术,相比高端 X3D 型号能以更低价格提供更佳游戏性能。
AMD 发布了 ROCm 7.14 'TheRock' 技术预览,带来了AI训练增强、针对Comfy UI等特定AI工作负载的性能提升高达16%,以及对开源GPU计算堆栈的持续Windows支持。
Qwen 3.5 122B 模型的一种紧凑型、重要性校准的 ROCmFP4 量化版本,适用于高内存 AMD 系统,实现了更优的质量(KLD 降低 14%)和性能(28.45 tok/s)。需要 ROCmFPX 运行时,不兼容标准 llama.cpp。
本文比较了在 Strix Halo(每天最多 0.48 美元)与 Nvidia A6000 上运行 AI 模型的能源成本,强调了能效和多功能性。
AMD 和 Meta 贡献者将 PyTorch Monarch 移植到 AMD Instinct GPU 并配合 ROCm,实现了大规模容错分布式训练。该博客详细介绍了工程工作以及在大型集群上的验证情况。
AMD RX 9070 XT 与 NVIDIA RTX 5070 Ti 显卡的对比,可能涵盖性能、特性和性价比。
AMD发布了Ryzen AI Halo开发套件,定价4000美元,面向AI开发者,提供强大硬件以支持本地AI工作负载。
分析了过去十年涨幅最大的科技股(如英伟达、AMD等)的共同特征,包括深度绑定技术浪潮、硬件转型可复购模式、经历大回撤、明星CEO等,并指出具身智能和机器人是AI界最被看好的方向,普通人应提前布局。
Wafer successfully runs GLM-5.2 on AMD MI355X with competitive performance, challenging NVIDIA's CUDA moat as AI agents automate software optimization, potentially eroding NVIDIA's high premium.
Wafer 证实,AMD MI355X GPU 在推理前沿模型(如 GLM5.2)时,提供了有竞争力的性能,且成本远低于 NVIDIA Blackwell,使用 MXFP4 量化和 sglang 框架,以不到一半的价格实现了 B200 80% 的吞吐量。
工程师成功在 AMD MI355X 上部署 GLM 5.2,达到每节点 2626 tok/s 和单流 213 tok/s 的性能,相当于 B200 吞吐量的约 80%,而成本不到 Blackwell 的一半。