@0x0SojalSec: 想象一下,在Kaggle上免费微调一个31B参数的多模态模型。现在你可以训练这个庞大的31B密集型多模态模型……
摘要
Unsloth 使得在Kaggle上免费微调31B参数的多模态模型成为可能,采用4位量化,本地运行仅需22-24GB VRAM。
查看缓存全文
缓存时间: 2026/06/20 14:37
想象一下,在Kaggle上免费微调一个310亿参数的多模态模型。
现在,您可以使用高效的4位量化(文本、图像、音频)来训练这个庞大的31B密集多模态模型,无需在GPU上烧钱。
非常适合定制代理、领域专用模型或进行前沿实验。
您甚至可以在仅22-24GB显存的情况下本地运行它。 定制代理、视觉任务或您自己的数据,全部解锁。
无论您是在构建专用助手,还是在推动开放模型的边界
对研究人员来说,这简直是改变游戏规则的利器。 更快的训练、更低的内存占用、完全掌控。
- http://kaggle.com/code/danielhanchen/gemma4-31b-unsloth…
相似文章
Show HN:在 4 GB 笔记本 GPU 上微调 8B 模型
Soup 是一个开源命令行工具,通过单条命令简化 LLM 的微调和后训练,支持基于 QLoRA 的训练,通过逐层流式传输仅需 4 GB 显存即可在消费级 GPU 上运行。最新版本新增了 DPO、ORPO、SimPO 和 KTO 等偏好损失,且不会使内存需求翻倍。
@UnslothAI: GLM-5.2 现在可以本地运行!2-bit 模型在从 1.51TB 缩小到 238GB(-84% 大小)后保留了约 82% 的准确率…
UnslothAI 宣布 GLM-5.2,Z.ai 的最强开源模型,拥有 744B 参数,现在可以通过动态 GGUF 量化在本地运行,将大小减少约 84% 至 239GB,同时保留约 82% 的准确率。它适用于 256GB Mac 以及 RAM/VRAM 配置,并支持长上下文、推理和代理任务。
@_vmlops:在单GPU上微调12B模型已成现实 大多数人以为需要庞大的GPU集群才能微调大型语言模型…
Hugging Face 的 PEFT 库实现了在单张 GPU 上对大型模型进行参数高效微调,在降低计算和存储成本的同时保持性能。
如果GPU能跑推理,那也应该能微调。[P]
USAF(超稀疏自适应微调)是一种新方法,允许在消费级GPU(包括AMD硬件)上微调MoE模型,仅需12GB VRAM。与无法做到的LoRA/QLoRA不同,USAF只训练最重要的稀疏权重和路由器。
@UnslothAI:Qwen3.8 现在可以在本地运行了!我们通过 Dynamic 1-bit 选择性量化层,将 Qwen3.8-2.4T-A95B 从 4.9TB 缩小到 397GB(-91% 体积)……
Unsloth 宣布 Qwen3.8 现在可以在本地运行,通过 Dynamic 1-bit 量化将 2.4T 参数模型从 4.9TB 缩小到 397GB,并提供了指南和 GGUF 版本。