标签
本文提出了VA-DPO,一种使用连续效价-唤醒维度在语言模型中进行可控情感生成的方法,它在不降低模型性能的前提下改进了提示技术。
本文研究了PEFT-BD,这是一种推测解码方法,使用类似LoRA的适配器作为块扩散起草器,并发现尽管接受的前缀数量可观,但由于起草器仍需进行完整的骨干前向计算,因此并未加速,即计算效率不高。
本文介绍了 GLoRA,这是一种面向联邦 LoRA 的规范感知服务器表示,旨在通过估计共识更新子空间来解决因子聚合中的语义不匹配问题。实验表明,在异构客户端场景下,GLoRA 在性能和效率方面均优于基线方法。
该文章推荐了一个视频,系统讲解了塑造当今AI行业的10篇核心论文,涵盖Transformer、LoRA、RAG、Agents及MCP协议,旨在帮助工程师理清技术脉络。