如何在 AMD Strix Halo 及其他非主流 AMD 硬件上微调大语言模型 (LLMs)

Reddit r/LocalLLaMA 工具

摘要

本文提供了在 AMD Strix Halo 硬件上使用监督微调 (SFT) 和 LoRA 方法微调大语言模型 (LLMs) 的教程,涵盖 Linux 及原生 Windows 环境。

我之前在这里发布的第一篇通用微调教程(https://www.promptinjection.net/p/the-ultimate-llm-ai-fine-tuning-guide-tutorial)收到了很多好评,有些人问我能否为 AMD Strix Halo 制作类似的教程。由于 ROCm 的存在,这里的处理方式确实大不相同。https://preview.redd.it/sz5zy2w6gh0h1.jpg?width=1456&format=pjpg&auto=webp&s=122f7834ea5501bd654085b9629120ef8d90eab9 我听取了大家的建议,教程现已发布:[https://www.promptinjection.net/p/how-to-fine-tune-llms-on-amd-strix-halo-ryzen-ai-max-395-sft-lora](https://www.promptinjection.net/p/how-to-fine-tune-llms-on-amd-strix-halo-ryzen-ai-max-395-sft-lora) \- Linux 和纯净版 Windows(无需 WSL!) \- 完整的 SFT 和 LoRA 支持
查看原文

相似文章

本地LLM推理优化:完整指南

Reddit r/LocalLLaMA

一份关于在消费级硬件上优化本地LLM推理的全面指南,涵盖llama.cpp、vLLM和LM Studio等工具,并提供关于内存层次结构、层放置和常见故障模式的实用建议。

AMD Strix Halo RDMA 集群搭建指南

Hacker News Top

一份使用自定义 Docker/Podman 工具箱,借助 ROCm/RCCL RDMA 支持,将两个 AMD Strix Halo 节点集群化,以在 256GB 统一内存上通过张量并行启用 vLLM 的搭建指南。

MLX微调示例指南

Reddit r/LocalLLaMA

一份关于在 Apple Silicon 上使用 MLX 和 LoRA 微调 7B 指令模型的详细指南,附有显示风格适应高奇幻文学语域的示例输出。