monte-carlo-dropout

标签

Cards List
#monte-carlo-dropout

评估基于BERT的模型在问答任务中的可靠性

arXiv cs.CL · 2026-08-12 缓存

本文评估了基于BERT的问答模型(RoBERTa、ALBERT、DistilBERT)在蒙特卡洛Dropout和输入改写条件下的可靠性,发现RoBERTa更为一致,并验证了MCD作为可靠性指标的有效性。

0 人收藏 0 人点赞
#monte-carlo-dropout

贝叶斯不确定性估计提升医疗AI代理的临床决策能力

arXiv cs.LG · 2026-07-24 缓存

本文表明,蒙特卡洛丢弃法能够为胸部X光片分类器提供认知不确定性信号,当以二元错误风险标志的方式传达时,可改善临床决策支持代理的错误检测,并减少自信误诊。

0 人收藏 0 人点赞
#monte-carlo-dropout

AI驱动碰撞仿真替代模型的不确定性量化:基于开源保险杠横梁基准的蒙特卡洛Dropout与深度集成对比研究

arXiv cs.LG · 2026-07-22 缓存

本文针对AI驱动碰撞仿真替代模型中的不确定性量化问题,对蒙特卡洛Dropout与深度集成方法进行了对比研究,采用开源保险杠横梁作为基准测试。

0 人收藏 0 人点赞
#monte-carlo-dropout

奖励模型可能过于敏感(22分钟阅读)

TLDR AI · 2026-06-29 缓存

本文认为强化学习中的奖励模型往往过于敏感,对同样好的回答给出不同分数,并提出了一个基于Monte Carlo dropout的免训练离散化算法来降低过度敏感性,从而提高策略质量。

0 人收藏 0 人点赞
#monte-carlo-dropout

奖励模型的离散化

Hugging Face Daily Papers · 2026-06-19 缓存

本文指出了连续奖励模型在强化学习中的过度敏感问题,即同等质量的回复被赋予不同的分数,并提出了一种使用蒙特卡洛dropout的离散化技术,以减少这种过度敏感,同时保持区分能力,从而得到更好的策略并减少奖励破解。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈