machine-learning-inference

标签

Cards List
#machine-learning-inference

ggml-cuda: hip: 添加缺失的 AMD GCN MMQ 配置 by thelittlefireman · Pull Request #27841 · ggml-org/llama.cpp - RDNA2(MI50, MI60) 的预填充性能改进

Reddit r/LocalLLaMA · 2天前 缓存

此拉取请求为 ggml-cuda 的 HIP 添加缺失的 AMD GCN MMQ 配置,增强了 llama.cpp 推理库中 RDNA2 GPU(如 MI50 和 MI60)的预填充性能。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈