AMD的Lemonade SDK为本地AI添加了NVIDIA CUDA支持

Reddit r/artificial 工具

摘要

AMD的Lemonade SDK在10.7版本中为本地AI添加了NVIDIA CUDA支持,使得在竞争对手的GPU上也能获得相同的本地AI服务器体验。该版本还引入了lemonade bench,用于跨后端的LLM基准测试,并提供了更广泛的Vulkan支持。

暂无内容
查看原文
查看缓存全文

缓存时间: 2026/06/11 14:07

AMD 的本地 AI 解决方案 Lemonade SDK 新增 NVIDIA CUDA 支持

来源:https://www.phoronix.com/news/AMD-Lemonade-10.7-Released AMD

Lemonade 是 AMD 开发的本地 AI 服务器解决方案,旨在兼容其 CPU、GPU 和 NPU 运行。今天发布的新版本增加了对 NVIDIA CUDA 的支持。

Lemonade SDK 提供本地 AI 服务器能力,其 API 兼容 OpenAI、Anthropic 和 Ollama 的 API。Lemonade 基于 FastFlowLM、vLLM、Llama.cpp 及其他组件构建,提供丰富、开源的本地 AI 体验。除了支持自家的 AMD Ryzen AI NPU、Radeon/Instinct GPU 加速器和 x86_64 CPU 外,此前已支持 Apple Metal GPU 和 AArch64 CPU。有趣的是,Lemonade 10.7 现在也新增了对 NVIDIA CUDA 的支持,允许在竞争对手的 GPU 上运行相同的本地 AI 服务器体验。

Lemonade NVIDIA CUDA 支持

Lemonade 10.7 正确集成了 Llama.cpp 在 Windows 和 Linux 上的 CUDA 后端,并在 Lemonade 中实现了正确的 NVIDIA GPU 检测以及其他集成细节。Linux 版本也加入了 stable-diffusion.cpp 的 CUDA 后端。此外,此版本还在 Windows 和 Linux 上为 stable-diffusion.cpp 添加了 Vulkan 支持,以提供更广泛的跨厂商 GPU 兼容性。

Lemonade 10.7 还增加了对 LMX-Omni 模型的支持,一个用于实时状态监控的原生 Prometheus 端点,以及其他增强功能。

Lemonade 10.7 最令人兴奋的是新增了 lemonade bench 命令,它专注于在 Llama.cpp、FastFlowLM、vLLM 和 Ryzen AI 软件之间进行公平的 LLM 基准测试。我将尝试 lemonade bench,看看它的基准测试效果如何,并希望在未来的 Phoronix 文章中使用它。

Lemonade 10.7 的下载及更多关于此开源功能版本的详细信息,请访问 GitHub (https://github.com/lemonade-sdk/lemonade/releases/tag/v10.7.0)。

相似文章

Lemonade v10.7 发布及项目组织更新

Reddit r/LocalLLaMA

Lemonade v10.7 版本引入了 LMX-Omni 虚拟模型,支持全模态聊天;新增 bench CLI 工具,用于跨后端比较 LLM 性能;并扩展了在 AMD、Apple Silicon、Nvidia 和 Intel 系统上的 GPU 支持。

@TheAhmadOsman: 本地AI现在很好了

X AI KOLs Following

Ahmad宣布了一个本地AI硬件竞技场,使用ODS在RTX PRO 6000、DGX Spark、Strix Halo、M5 MacBook Pro和ChatGPT等硬件上对LLM进行基准测试,并邀请社区为未来的比较提供意见。

AMD / Strix Halo+ 用户的大新闻

Reddit r/LocalLLaMA

AMD Strix Halo 设备上的 NPU 现在可用于 AI 推理,支持混合模式,结合 NPU 和 iGPU 以实现更快的提示处理。Lemonade 和 AMD 的 ROCm 等软件使之成为可能。

Lemonade 设备:一台超越硬件的私有 AI 服务器

Reddit r/LocalLLaMA

Lemonade 已从 Python SDK 演变为一个打包的设备,作为 systemd 服务运行,支持多种 AI 模型、图像生成、语音转文字和文字转语音,跨 AMD、NVIDIA 和 Apple 硬件,强调隐私和零边际成本的批量处理。