LoRA Speedrun – 微调技术实际耗时公开排行榜

Hacker News Top 工具

摘要

LoRA Speedrun 是一个微调技术的实际耗时公开排行榜,通过自动化验证,在单块 L40S GPU 上使用 Qwen2.5-1.5B 和 SmolLM2-1.7B 模型,测量 LoRA 适配器在 GSM8K 和 SQuAD 任务上达到目标准确度的速度。

暂无内容
查看原文
查看缓存全文

缓存时间: 2026/07/20 09:46

一次真实的验证,从日志中回放(种子463953844,时间压缩):训练 →完整性 + 适配器审计 →评估 →3-seed判定。

相似文章

超越LoRA:稀疏诱导的适配是否更好?

arXiv cs.LG

本文提出了对LoRA的稀疏诱导适配方法,包括廉价LoRA(cLA)和链式循环变体(c³LA),并提供了理论泛化界以及实证评估,结果显示在保持竞争性性能的同时,训练时间最多减少10%,峰值GPU内存节省最多15%。