llm-consistency

标签

Cards List
#llm-consistency

当大语言模型意见一致时,它们是对的吗?——将自洽性与跨模型一致性作为置信度信号的审计

arXiv cs.AI · 2026-07-10 缓存

本文审计了自洽性与跨模型一致性是否是LLM正确性的可靠指标,发现一致性是一个弱的、依赖于场景的代理指标,且前沿模型表现出过度自信。

0 人收藏 0 人点赞
#llm-consistency

使用语法与语义上下文评估汇总(SSAS)的情感预测一致性分析

arXiv cs.CL · 2026-04-20 缓存

本论文提出了SSAS(语法与语义上下文评估汇总)框架,旨在通过分层分类和迭代汇总来减少噪声和方差,提高基于大语言模型的情感预测的一致性。在三个行业标准数据集上的实证评估显示,数据质量和企业决策可靠性可提升30%。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈