@hasantoxr:微调你自己的 LLM 现在变得超级简单。每个人都跟我说他们很想训练一个定制模型,但太难了……
摘要
Soup 是一款新的 CLI 工具,将 LLM 微调简化到一条命令,提供聊天、代码、工具调用等模板,并支持分层流式加载,可在中等 GPU 上运行。
查看缓存全文
缓存时间: 2026/08/10 23:37
Soup
一个命令即可微调和后训练 LLM。无需 SSH,无需配置地狱。
网站 · 快速开始 · 配置 · 文档 · 命令 · 模型 · Discord
在 4 GB 显存的 RTX 3050 笔记本上,使用 Llama-3.1-8B-Instruct + NF4、LoRA、batch 1、seq 512——峰值显存 3.32 GB,119.6 tok/s。完整视频(90秒)
相似文章
@tom_doerr:通过无代码 GUI 微调大型语言模型 https://github.com/h2oai/h2o-llmstudio…
H2O LLM Studio 是一个开源框架和无代码图形界面,可简化大型语言模型的微调过程,支持 LoRA、DPO 等技术,并能与 Hugging Face 集成。
Show HN:在 4 GB 笔记本 GPU 上微调 8B 模型
Soup 是一个开源命令行工具,通过单条命令简化 LLM 的微调和后训练,支持基于 QLoRA 的训练,通过逐层流式传输仅需 4 GB 显存即可在消费级 GPU 上运行。最新版本新增了 DPO、ORPO、SimPO 和 KTO 等偏好损失,且不会使内存需求翻倍。
@Sumanth_077:训练大型LLM曾经慢得令人痛苦,但现在不同了!4个加速微调的开源库…
一条推文,重点介绍了四个开源库(Unsloth、LLaMA Factory、DeepSpeed、Axolotl),这些库通过内存和速度优化加速大型语言模型的微调。
@heygurisingh: 过去训练参数量达数十亿的LLM需要花费1000万美元以上。有人开源了一个仓库,现在可以在单张GPU上完成。
一个名为train-llm-from-scratch的开源仓库使得在单张GPU上训练十亿级参数的LLM成为可能,它提供了一个从原始文本到推理的可配置流水线,包括数据集流式加载和检查点保存,采用MIT许可证。
@akshay_pachaar: 如果要定制LLM,我会学习的微调技术:收藏此推。1. LoRA 2. QLoRA 3. Prefix Tuning 4. A…
该推文列出了15种LLM微调技术,并介绍了ART(Agent Reinforcement Trainer),这是OpenPipe的一个开源框架,用于使用GRPO训练多步骤代理,并通过W&B Training提供无服务器强化学习支持。