kernel-benchmarks

标签

Cards List
#kernel-benchmarks

LLM4LLM:通过闭环智能体优化桥接内核基准测试与实际部署

arXiv cs.AI · 2026-08-25 缓存

LLM4LLM引入了一个部署感知的闭环优化框架,用于桥接内核基准测试和实际LLM推理,在H100 GPU上实现了高达6.98倍的加速。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈