regularization

标签

Cards List
#regularization

通过将公平性视为对称操作来检测和缓解偏见

arXiv cs.AI ↗ · 2026-06-08 缓存

本文提出将公平性视为机器学习分类器中的对称操作,通过基于损失的规范化来实现在固定能力特征的同时,交换敏感属性时的不变性。该框架实现了超过90%的偏见减少,且准确率损失极小,无需因果图知识。

0 人收藏 0 人点赞
#regularization

基于后验混合贝叶斯信念的正则化离线策略优化

arXiv cs.AI ↗ · 2026-06-02 缓存

本文介绍了后验混合贝叶斯信念(PhyB),这是一个将贝叶斯强化学习中的期望重新表述为动力学模型的凸组合的框架,从而能够实现具有有界目标差异和最新性能的高效正则化离线策略优化。

0 人收藏 0 人点赞
#regularization

TASER:面向几何驱动鲁棒性的任务感知Stein正则化

arXiv cs.LG ↗ · 2026-06-01 缓存

介绍了TASER,一种从Langevin Stein算子导出的训练时正则化框架,它鼓励预测器与数据密度之间的几何兼容性,提高了CIFAR-10上的对抗鲁棒性和稳定性,而不会显著降低干净准确率。

0 人收藏 0 人点赞
#regularization

迷宫与线索:重新思考大语言模型中序列知识编辑的正则化

arXiv cs.CL ↗ · 2026-05-27 缓存

本文研究了大型语言模型中序列知识编辑的底层机制,表明许多正则化策略是不必要的,并且稳定性源于正确考虑累积的编辑约束而自然产生。

0 人收藏 0 人点赞
#regularization

@latkins: Fern 是最棒的之一

X AI KOLs Timeline ↗ · 2026-05-26 缓存

Fern 宣布了一种新的正则化技术,解决了 SolidGoldMagikarp 稳定性问题,详情将在后续帖子中说明。

0 人收藏 0 人点赞
#regularization

利用梯度惩罚潜在动力学实现平滑梦想与高效采样

arXiv cs.LG ↗ · 2026-05-25 缓存

GPLD为DreamerV3引入了梯度惩罚潜在动力学正则化器,强制转换学习中的局部平滑性,提高了连续控制任务(尤其是复杂运动)的样本效率。

0 人收藏 0 人点赞
#regularization

OmniISR: 一种通过中间监督与正则化实现集中式与联邦学习的统一框架

arXiv cs.LG ↗ · 2026-05-21 缓存

OmniISR提出了一种统一框架,通过在隐藏层引入中间监督与正则化,将集中式学习和联邦学习相结合,提供了理论收敛保证,并将CL-FL差距缩小了22.60%。

0 人收藏 0 人点赞
#regularization

LoRA 与权重衰减 (2023)

Hacker News Top ↗ · 2026-05-18 缓存

这篇博客文章探讨了LoRA与权重衰减的相互作用如何导致与全参微调不同的优化目标,其中权重被正则化到初始模型而不是零。它解释了对实践者的影响。

0 人收藏 0 人点赞
#regularization

Sub-JEPA:对LeCun团队的LeWorldModel的一个简单修复,可一致提升性能 [P]

Reddit r/MachineLearning ↗ · 2026-05-18

Sub-JEPA通过在冻结的随机正交子空间中应用高斯正则化来改进LeWorldModel,在基准测试中一致优于原始版本,改进幅度高达+10.7个百分点。

0 人收藏 0 人点赞
#regularization

逐层导数控制网络

arXiv cs.LG ↗ · 2026-05-18 缓存

介绍了ChainzRule,一种使用多项式引擎和微分正则化的神经架构,用于平衡准确性、硬件效率和功能稳定性,以15.5倍的参数减少和更平滑的梯度优于标准模型。

0 人收藏 0 人点赞
#regularization

无奖励的表征:JEPA对LLM微调的审计

arXiv cs.LG ↗ · 2026-05-18 缓存

本文对联合嵌入预测架构(JEPA)在自然语言到正则表达式任务上的LLM微调进行了审计,测试了二十二个辅助目标。结果表明,隐藏状态表征的改进与解码任务准确率之间仅存在弱耦合,没有辅助目标通过族系校正。

0 人收藏 0 人点赞
#regularization

有限理性、对冲与泛化

arXiv cs.LG ↗ · 2026-05-18 缓存

本文通过有限理性决策理论的视角研究学习中的泛化问题,其中学习者的响应规律在训练损失和样本依赖性之间产生权衡。作者表明这种权衡由 f-散度正则化器控制,并且泛化可以从学习者的对冲行为中得到验证。

0 人收藏 0 人点赞
#regularization

R2R2: 通过自预测学习中的冗余减少实现鲁棒表示,用于密集经验重用

arXiv cs.LG ↗ · 2026-05-15 缓存

提出R2R2,一种用于强化学习中自预测学习的正则化方法,以缓解高更新-数据比下的过拟合,在连续控制任务上取得了显著改进。

0 人收藏 0 人点赞
#regularization

保持旋转的有监督微调

arXiv cs.LG ↗ · 2026-05-13 缓存

本文介绍了保持旋转的有监督微调(RPSFT),这是一种通过在微调过程中保持预训练奇异子空间中的投影旋转来提高域外泛化能力的方法。

0 人收藏 0 人点赞
#regularization

FragileFlow:通过频谱控制正确但脆弱的预测以增强基础模型的鲁棒性

arXiv cs.CL ↗ · 2026-05-12 缓存

本文介绍了 FragileFlow,这是一种插件式正则化器,通过频谱分析和 PAC-Bayes 界来控制“正确但脆弱”的预测,从而提高 LLM 和 VLM 的鲁棒性。

0 人收藏 0 人点赞
#regularization

超越惩罚机制:基于扩散模型的离线强化学习分布外检测与选择性正则化

arXiv cs.LG ↗ · 2026-05-12 缓存

本文介绍了 DOSER,这是一种利用扩散模型进行分布外(OOD)检测和选择性正则化的框架,旨在离线强化学习中通过区分有益和有害的 OOD 动作来提升在静态数据集上的表现。

0 人收藏 0 人点赞
#regularization

Sub-JEPA:用于稳定端到端世界模型的子空间高斯正则化

Hugging Face Daily Papers ↗ · 2026-05-10 缓存

作者提出了 Sub-JEPA,这是一种利用子空间高斯正则化来提高 LeWM 等端到端世界模型稳定性的方法,在连续控制基准测试中表现出一致的性能提升。

0 人收藏 0 人点赞
#regularization

理解并强制任务算术中的权重解耦

Hugging Face Daily Papers ↗ · 2026-04-18 缓存

本文提出即插即用正则项 OrthoReg,通过在微调阶段强制权重正交,无需额外计算即可提升任务算术与模型融合效果。

0 人收藏 0 人点赞
#regularization

半监督文本分类的对抗训练方法

OpenAI Blog ↗ · 2016-05-25 缓存

本文提出了针对文本分类的对抗训练和虚拟对抗训练方法,通过在RNN中对词嵌入而非原始输入施加扰动来实现。该方法在半监督和监督文本分类基准上取得了最先进的结果,同时降低了过拟合。

0 人收藏 0 人点赞
← Previous
← 返回首页

提交意见反馈