loss-function

标签

Cards List
#loss-function

UASPL:基于证据神经网络的不确定性感知自步学习

arXiv cs.LG · 2026-07-09 缓存

本文提出UASPL,一种将预测可靠性融入自步学习样本选择的方法,使用证据神经网络,提升了分类性能和可解释性。

0 人收藏 0 人点赞
#loss-function

Spec-AUF:掩码块草稿模型中训练-推理不一致下的“接受直到失败”训练

arXiv cs.AI · 2026-07-03 缓存

本文提出AUF(接受直到失败),这是一种针对推测解码中掩码块草稿模型的交叉熵损失的简单修改,它将监督限制到第一个预测失败之前的词缀,在不改变推理的情况下提升了多个基准测试的平均生成长度。

0 人收藏 0 人点赞
#loss-function

通过平滑MMD对齐增强LLM中的数值预测

arXiv cs.CL · 2026-06-29 缓存

引入平滑最大均值差异(SMMD),一种损失函数,通过核匹配和基于图的平滑性将预测数值分布与目标对齐,提高了LLM在多个任务中的数值预测准确性。

0 人收藏 0 人点赞
#loss-function

用于多站点污染预测的自配置可解释图神经网络

arXiv cs.LG · 2026-06-25 缓存

本文提出了一种基于混淆矩阵的图构建方法和一种用于图神经网络的混合损失函数,以提高多站点污染预测的准确性和可解释性,并在真实世界空气污染数据上进行了评估。

0 人收藏 0 人点赞
#loss-function

@pallavishekhar_: 梯度下降背后的数学原理 在此阅读:https://outcomeschool.com/blog/math-behind-gradient-descent…

X AI KOLs Timeline · 2026-05-26 缓存

这篇博客文章通过逐步的数值示例和直观理解,解释了梯度下降(训练机器学习模型所使用的基本优化算法)背后的数学原理。

0 人收藏 0 人点赞
#loss-function

DEL:大型语言模型数值学习的数字熵损失

arXiv cs.CL · 2026-05-21 缓存

本文提出数字熵损失(DEL),一种用于大型语言模型数值学习的新型损失函数。它重新定义了熵优化,以提高数字级预测精度并处理浮点数,在数学推理基准上持续优于现有方法。

0 人收藏 0 人点赞
#loss-function

D-PACE: 面向并行推测草稿的动态位置感知交叉熵

arXiv cs.LG · 2026-05-20 缓存

本文介绍了D-PACE,一种用于训练推测解码草稿模型的动态位置感知交叉熵损失,该损失函数自适应地加权位置以提升接受长度和推理速度,在各基准测试中实现一致的加速比,且开销极低。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈