@DailyDoseOfDS_: 将任意自回归LLM转换为扩散LM。dLLM是一个Python库,统一了扩散语言模型的训练与评估…
摘要
dLLM是一个开源Python库,能以极少的计算资源将任意自回归语言模型转换为扩散语言模型,统一训练和评估。
将任意自回归LLM转换为扩散LM。
dLLM是一个Python库,统一了扩散语言模型的训练与评估。
你还可以用它以极少的计算资源将任意自回归LM转换为扩散LM。
100%开源。https://t.co/oJTEiKz6UM
查看缓存全文
缓存时间: 2026/05/16 15:20
将任意自回归大语言模型(LLM)转换为扩散语言模型。
dLLM 是一个 Python 库,统一了扩散语言模型的训练与评估。
你也可以用它以极少的计算资源将任意自回归语言模型转换为扩散语言模型。
100% 开源。https://t.co/oJTEiKz6UM
相似文章
@DivyanshT91162: 自回归大语言模型可能正在被取代 有人构建了dLLM——一个开源库,可以将任何自…
dLLM是一个开源库,可将任何自回归大语言模型转换为扩散大语言模型,实现并行解码和更快的文本生成。
$R^2$-dLLM:通过时空冗余削减加速扩散大语言模型
R²-dLLM 引入时空冗余削减技术,在保持生成质量的同时将扩散 LLM 的解码步数最多压缩 75%,直击部署瓶颈。
Dynamic-dLLM:动态缓存预算与自适应并行解码,实现扩散大语言模型的无训练加速
本文提出 Dynamic-dLLM,一种无训练框架,通过动态分配缓存更新预算和校准解码阈值来加速扩散大语言模型,在 LLaDA 和 Dream 等模型上实现超过 3 倍的加速,同时保持性能。
不要重新训练,只需对齐:通过表征对齐将自回归语言模型适配为扩散语言模型
本文介绍了 Repr-Align,一种通过表征对齐将自回归语言模型适配为扩散语言模型的方法,无需从头重新训练表征即可实现高达 4 倍的训练加速。
通过在线策略蒸馏实现数据高效的自回归到扩散语言模型
本文介绍了OPDLM,一种通过在线策略蒸馏将自回归语言模型转换为扩散语言模型的方法,所需训练令牌数量减少15倍到7000倍,同时保留原始模型的知识。