分数匹配学习的有限样本界
摘要
本文首次为使用分数匹配学习多项式指数族提供了非渐近样本复杂度界,显示出对模型维度的多项式依赖。
查看缓存全文
缓存时间: 2026/05/15 06:27
# 基于得分匹配学习的有限样本界 来源:https://arxiv.org/abs/2605.14168 查看PDF (https://arxiv.org/pdf/2605.14168) > **摘要:** 对于具有无界支撑的连续指数族分布的学习,无论从理论还是高维统计的应用角度来看,仍然是一个重要的研究方向。近年来,得分匹配已成为学习连续变量指数族的常用方法,因为与极大似然估计相比,它在计算上更为简便。然而,对得分匹配统计性质的理论理解仍显不足。本文针对多项式指数族结构的学习,给出了基于得分匹配的非渐近样本复杂度分析。推导出的样本界显示其与模型维度呈多项式依赖关系。这些界是此类结果中的首例,因为此前所有工作仅给出了样本复杂度的渐近界。 ## 提交历史 来自:Devin Smedira [查看邮件 (https://arxiv.org/show-email/961e51ad/2605.14168)] **\[v1\]** Wed, 13 May 2026 22:48:18 UTC (31 KB)
相似文章
Sample Complexity of Multicalibration for Multilevel Properties
This paper studies the sample complexity of multicalibration for a sequence of properties that are sequentially identifiable, establishing matching upper and lower bounds up to logarithmic factors.
从比分矩阵到足球感知的比赛状态模拟:用于精确比分重排的可审计LLM框架
本文介绍了一个用于精确比分足球预测的可审计LLM框架,该框架在四个系统迭代中整合了动态泊松族模型与基于LLM的上下文推理,并提供了2025-26赛季英格兰足球超级联赛比赛的探索性结果。
学会匹配:具有时间扩展反馈的双边匹配
本文介绍了一个具有时间扩展反馈的双边匹配框架,将其建模为部分可观测的马尔可夫博弈,包含昂贵筛选、噪声观测和动态变化的潜在特征。作者提出了多智能体强化学习基准Learn2Match,并展示了独立PPO在社会福利方面优于bandit基线,但信息摩擦损失更高。
Marginal Matching Does Not License Factorized Sampling: Auditing Conditional Style Leakage in Factorized Generative Models
This paper shows that matching a marginal Gaussian prior in factorized generative models does not prevent conditional style leakage, where style latents carry class information. Multiple remedies are explored, but the authors conclude that marginal statistics alone cannot certify class-invariance.
基于Lyapunov的弱耦合MDP样本复杂度分析
本文研究了平均奖励弱耦合MDP和休止臂赌博机学习中的样本复杂度,利用一种新颖的基于Lyapunov的分析框架,确立了具有多项式复杂度的有限样本PAC保证。