flashinfer

标签

Cards List
#flashinfer

@h100envy: 构建了NVIDIA TensorRT-LLM内核的CMU博士用68分钟讲解快速注意力——比1200美元的GPU课程更胜一筹

X AI KOLs Timeline · 2026-07-02 缓存

一位开发了NVIDIA现用于TensorRT-LLM的内核的CMU博士讲解了快速注意力,内容涵盖融合CUDA内核、FlashInfer、Triton和分页KV注意力,使同一GPU每秒能处理更多token。

0 人收藏 0 人点赞
#flashinfer

@KeisukeKamahori: 非常激动地分享,我们在@UWSyFi的团队在#M…举办的FlashInfer AI内核生成竞赛中赢得了多个奖项。

X AI KOLs Following · 2026-05-22 缓存

华盛顿大学SyFI团队在MLSys2026期间举办的FlashInfer AI内核生成竞赛中赢得了多个奖项,得到了NVIDIA和Modal的支持。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈