training-objective

标签

Cards List
#training-objective

潜在递归LLM系统的原理性思考

Hugging Face Daily Papers ↗ · 6天前 缓存

本文提出REST,一种针对潜在递归LLM系统的新型训练目标,通过将因果性和最小化等特性融入可微损失中,在基准测试中将准确率提高了多达7.5个百分点。

0 人收藏 0 人点赞
#training-objective

通过验证器与生成器的对齐改进LLMs

arXiv cs.CL ↗ · 2026-07-07 缓存

一种新方法FLORA(频率校正的有序秩对齐学习)通过基于原理的频率校正确对齐生成器和验证器模式,改进了LLMs。实验表明,在IFEval和HumanEval等基准测试上,G-V一致性和生成器性能均取得了显著提升。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈