在 Razer 外接盒中使用 Thunderbolt 5 运行 AMD Radeon AI PRO R9700 的 MacBook Pro M5 Max LSE LLM

Reddit r/LocalLLaMA 新闻

摘要

本文介绍了一种配置,通过 Thunderbolt 5 在 MacBook Pro 上使用 AMD Radeon AI Pro R9700 GPU,结合自定义驱动和 LemonSeed-Engine 运行大语言模型如 Qwen3.6-3.8。

大家好!对于任何能在苹果设备上编译代码的人来说,好消息是,你现在可以在 MacBook Pro、Mac mini、Mac Studio 或任何具有 Thunderbolt 接口的 OSX 变体上体验使用 AMD Radeon AI Pro R9700,接下来是配备 M 系列处理器的 iPad!驱动程序现在似乎工作得很稳定了,并且我正在继续优化我的引擎 LSE 或 LemonSeed-Engine。它支持 Qwen3.6 - 3.8 密集和/或 MoE 与 MTP,它仅通过我从 Linux 移植到 Mac 的 amdgpu 驱动程序在 Mac 上工作,而引擎在 Linux 上工作。HIPC 后端在 Linux 上工作最佳,Loom / HRX 后端在 Mac 上工作最佳,只有 LOOM / HRX 组合可以在 Mac 上运行。HIPC 和 Loom 都使用 HRX,这是一个新的 AMD 系统,允许我们在 amdgpu 上运行 hipc 和/或 loom 内核。希望你喜欢我的设置,如果你和我一样,你会觉得这超级酷,如果你不是,你可能会讨厌它,哈哈!附言:你可能或可能不会在 Lemonade 中找到这个。MacBook Pro M5 Max - 128GB AMD Radeon AI Pro R9700 Razer Core X V2 https://github.com/lemonade-sdk/mac-amdgpu - 驱动程序 https://github.com/Geramy/LSE - LLM 引擎 https://github.com/lemonade-sdk/lemonade - Lemonade SDK 组织
查看原文

相似文章

@alexocheema:在两台 M5 Max MacBook Pro 上通过 Thunderbolt 5 RDMA 运行 Qwen3.6 35B(视觉版)。模型能描述图片并正确识别 Apple Park,但把 John Ternus 错认成 Jeff Williams。借助前缀缓存,响应几乎瞬间完成。

X AI KOLs Timeline

在两台 M5 Max MacBook Pro 上通过 Thunderbolt 5 RDMA 运行 Qwen3.6 35B(视觉版)。模型能描述图片并正确识别 Apple Park,但把 John Ternus 错认成 Jeff Williams。借助前缀缓存,响应几乎瞬间完成。

我刚刚从MacBook M5 pro 48 GB换到了RTX3090

Reddit r/LocalLLaMA

一位软件开发者分享了从MacBook换到RTX3090 Linux设置来运行AI模型的经历,使用Qwen 3.8 27B实现了显著更高的推理速度,并可能取代他的Claude订阅。