over-inference

标签

Cards List
#over-inference

个性化幻象:LLM如何虚构用户画像,以及为何自我监控具有误导性

Hugging Face Daily Papers · 2026-08-05 缓存

本文介绍了MirageBench,这是一个基准测试,表明具有持久记忆的LLM有35%至49%的时间通过过度推断虚构用户画像,并揭示模型自报的置信度与实际过度推断呈负相关,使得自我监控在比较模型时不可靠。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈