confidence

标签

Cards List
#confidence

你确定你确定吗?论指令微调对置信度与词汇多样性的影响

Hugging Face Daily Papers · 3天前 缓存

本文研究指令微调如何影响问答任务中的模型置信度与词汇多样性,发现指令微调会改变置信度并降低推理多样性,但并未改善校准性能。

0 人收藏 0 人点赞
#confidence

“无审查”大模型在可测量上比其基础模型更乐观

Reddit r/LocalLLaMA · 2026-07-29

一项针对无审查大模型(Gemma和Qwen)的研究表明,去除审查会使其在股市预测中更加乐观,但不会更准确。效果因模型家族而异。

0 人收藏 0 人点赞
#confidence

DeepLook: 前瞻引导的深层推理

arXiv cs.AI · 2026-07-28 缓存

DeepLook是一个无需训练的框架,通过在不确定性瓶颈处分配计算来提升LLM的推理能力,平均减少87.3%的token生成,同时提高竞赛数学基准的准确性。

0 人收藏 0 人点赞
#confidence

用于检索增强生成的双置信对比解码

arXiv cs.CL · 2026-07-02 缓存

提出双置信对比解码(DCCD),一种无需训练的检索增强生成方法,通过结合文档级和词元级置信信号处理多文档场景中的上下文内部冲突,并引入事实冲突问答基准DRQA。

0 人收藏 0 人点赞
#confidence

为什么我们会因为AI回答听起来自信就信任它?

Reddit r/artificial · 2026-07-01

作者反思了人们为何会信任听起来自信的AI答案,尤其是在金融领域,并介绍了他们的项目AutoFlow——一个信用证据引擎,旨在根据源证据验证金融主张并突出矛盾。

0 人收藏 0 人点赞
#confidence

当校准排名反转时:面向LLM公平比较的精度控制评估

arXiv cs.CL · 2026-07-01 缓存

本文证明,诸如期望校准误差(Expected Calibration Error)等全局校准指标会受到模型精度的混杂影响,并提出了ACE,一个用于公平比较大语言模型的精度控制评估框架。

0 人收藏 0 人点赞
#confidence

TriageRA-CCF:面向自适应秩预算的源端临床置信度与覆盖信号(用于医学大语言模型)

arXiv cs.CL · 2026-06-30 缓存

本文提出TriageRA-CCF,一种用于医学问答中LoRA自适应秩预算的方法。它利用源端信号(基座模型置信度、临床覆盖、反事实代理)动态选择秩预算,在Qwen3-8B和Llama3.1-8B上取得了适度的准确率提升。

0 人收藏 0 人点赞
#confidence

智能体记住一切听起来很有用,直到它记错了那些乱七八糟的东西

Reddit r/AI_Agents · 2026-06-17

作者批评了让智能体记住一切的想法,并介绍了TrueMemory,这是一个将记忆转化为带有置信度和证据的特质主张的系统,旨在更好地校准智能体行为。

0 人收藏 0 人点赞
#confidence

如果你的代理在执行自主操作时出错,你能重建其决策原因或仅知道它做了什么吗?

Reddit r/AI_Agents · 2026-06-16

一位开发自主计费代理的开发者讨论了事后重建代理决策原因的困难,并描述构建了一个工具(Attova),该工具记录决策的证据、替代方案和置信度,以改进调试和人工审查。

0 人收藏 0 人点赞
#confidence

LLMs 未显示出个体化元认知迹象

arXiv cs.LG · 2026-05-26 缓存

本文研究了前沿大语言模型是否表现出个体化元认知——即超越共享信号评估自身项目级别能力的能力。通过对20个模型和六个基准进行因子分析和成对校准,作者未发现此类元认知的证据;置信度差异归结为一个单一的共享难度因子,表明模型依赖于共同的难度信号而非模型特定的自我认知。

0 人收藏 0 人点赞
#confidence

Claude让我意识到大多数AI模型优化的是自信而非真相

Reddit r/artificial · 2026-05-22

反思许多AI模型如何更注重听起来自信而非真实,以Claude为例,它似乎更注重内部一致性和逻辑诚实。

0 人收藏 0 人点赞
#confidence

基于语义级奖励的LLM校准

arXiv cs.CL · 2026-05-18 缓存

提出了CSR,一种直接在语义空间中使用新颖的语义校准奖励来校准LLM的框架,在多个数据集上将ECE降低了高达40%,并将AUROC相较于口头化置信度基线提升了高达31%。

0 人收藏 0 人点赞
#confidence

@mitsuhiko: 我觉得如果大家能坦诚地说明自己对某个话题/他们的拉取请求的实际理解程度就好了…

X AI KOLs Timeline · 2026-05-16

阿明·罗纳赫(@mitsuhiko)建议,人们在提交拉取请求时应坦诚说明自己对话题的实际理解,因为AI工具(称为'clanker')让人很容易在缺乏真正知识的情况下显得很自信。

0 人收藏 0 人点赞
#confidence

@WorldExecAI: 富二代,明顯不如富一代自信?這次宴會,幾個富二代,被安排在馬斯克和黃仁勳旁邊,但他們與硅谷巨人毫無交流,明顯不如馬雲、張朝陽和李彥宏。特斯拉CEO馬斯克的左邊憨笑的,叫曹暉,福耀玻璃創始人曹德旺兒子。英偉達CEO黃仁勳的旁邊,是魯偉鼎,萬…

X AI KOLs Timeline · 2026-05-14 缓存

文章讨论了一场宴会上,富二代被安排在马斯克和黄仁勋旁边却缺乏交流,对比第一代创业者如马云、张朝阳等人的自信,引发对两代企业家差异的讨论。

0 人收藏 0 人点赞
#confidence

确定性的幻觉:解耦策略蒸馏中的能力与校准

Hugging Face Daily Papers · 2026-04-18 缓存

本文发现语言模型中的策略蒸馏(OPD)因训练与部署信息不匹配导致严重过度自信,提出校准感知框架 CaOPD,在提升性能的同时显著增强置信度可靠性。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈