@levidiamode: GPU编程第248天/365天 Cerebras的CTO在网上还有其他很棒的演讲。例如,两年前的一次演讲……
摘要
一篇社交媒体帖子,突出了Cerebras CTO关于GPU编程和AI硬件架构的演讲,并指出尽管内容信息量大,但观看次数很少。
查看缓存全文
缓存时间: 2026/09/08 23:40
GPU编程第248天/365天
Cerebras的CTO在线上还有其他精彩演讲。例如两年前关于WSE-3核心的讲解,或是Hot Chips 34上对芯片内存系统与互连架构的深度剖析。
令我惊讶的是,2026年了这些演讲观看量仍寥寥无几,但这恰恰说明AI硬件领域的信息依然高度分散。
levidiamode (@levidiamode): GPU编程第247天/365天
康奈尔大学机器学习硬件课程中,Cerebras首席技术官肖恩·李2022年的客座讲座堪称精彩——他系统梳理了架构与微架构的历史性创新、制程工艺的性能提升、良率挑战的解决方案、冗余设计及光刻技术等核心议题。
相似文章
@levidiamode: Day 138/365 of GPU Programming 今年我最喜欢的讲座之一是斯坦福大学的CS336第7讲关于GPU…
一位学习者分享了对斯坦福大学CS336第7讲关于GPU并行性的热情,该讲座涵盖了基本操作,并将其连接到多GPU设置以及张量并行、数据并行和流水线并行等技术。
@levidiamode: GPU编程第157/365天:另一个对我非常有帮助的FlashAttention4资源是@charles_irl的演讲…
一个每日GPU编程帖子重点介绍了Charles_irl的演讲,该演讲在论文发布前逆向工程了FlashAttention4代码,并赞扬了Modal团队对代码的深入剖析和对前向传播的合理推断。
@levidiamode: GPU编程的第163/365天 - 今天看几个不同的agentic GPU内核优化系统。我最感兴趣的两个是…
一条推文讨论了两种agentic GPU内核优化系统:@dogacel0的Auto GPU Kernel和@songhan_mit实验室的Kernel Design Agents,两者均在MLSys Sparse Attention FlashInfer比赛中获胜。该帖子突出了使用子代理和Claude技能进行GPU编程的不同方法。
@neural_avb: 今日发现 "GPU Mode" 他们有一个YouTube系列来学习CUDA。还有一个GitHub仓库包含幻灯片/笔记本。一些讲座是…
GPU Mode 是一个学习资源,包含YouTube系列、GitHub仓库(含幻灯片/笔记本)以及一个类似Leetcode的练习网站,用于掌握CUDA编程。
@vivekgalatage: GPU Programming Fundamentals https://youtu.be/Cl2B_hmg4gA William Brandon, a performance engineer at Anthropic, outline…
William Brandon(Anthropic 性能工程师)的 GPU 编程基础讲座摘要,强调理解 GPU 硬件的流式多处理器(SM)结构是预测性能的关键,而非仅从线程块/线程的软件抽象出发。