hallucination

标签

Cards List
#hallucination

金融智能体可以拒绝给出最终答案,却仍在边缘问题上产生幻觉

Reddit r/AI_Agents ↗ · 2026-09-01

文章指出,AI金融智能体拒绝给出最终答案时,仍可能通过编造辅助信息而产生幻觉,引发对此是否构成不确定性评估失败的思考。

0 人收藏 0 人点赞
#hallucination

HalluPrism:当多模态不确定性应进行诊断而非决策时

arXiv cs.LG ↗ · 2026-09-01 缓存

本文介绍了HalluPrism,这是一种针对多模态大语言模型的行为诊断方法,它使用视觉扰动探针来识别幻觉故障模式,改进了仅基于置信度的故障类别分类方法。

0 人收藏 0 人点赞
#hallucination

一种能通过事实核查的幻觉类别:陈述属实,但引号是伪造的

Reddit r/ArtificialInteligence ↗ · 2026-08-30

本文描述了一种AI幻觉类型:陈述内容准确但引号内文字为虚构,从而规避标准事实核查,并探讨了检测此类错误的实施挑战。

0 人收藏 0 人点赞
#hallucination

[在此插入AI]是AI,并且可以(即有完全法律许可)犯错

Reddit r/ArtificialInteligence ↗ · 2026-08-29

文章认为,像'AI可以犯错'这样模糊的法律免责声明降低了AI公司提高质量的动机,导致幻觉率的逐底竞争。

0 人收藏 0 人点赞
#hallucination

拒绝不等于鲁棒性:审计大型语言模型在可证无信息临床疼痛语音转录中的自信编造

arXiv cs.AI ↗ · 2026-08-28 缓存

本文审计了大型语言模型在临床疼痛语音转录中的拒绝和编造行为,发现权威框架提示会导致如Gemini 2.5 Flash和Llama 3.1 8B等模型产生自信编造,而合作提示则显示出稳健的弃权行为。

0 人收藏 0 人点赞
#hallucination

LLMs中的幻觉:基于生命周期的成因、检测、缓解与预防综述

arXiv cs.CL ↗ · 2026-08-28 缓存

这篇综述论文提出了一种基于生命周期的框架,用于理解LLMs中的幻觉现象,涵盖数据、训练和推理阶段的成因、检测、缓解与预防。

0 人收藏 0 人点赞
#hallucination

我的AI系统捏造了一段详细记忆,还被当作真实历史写进了书稿草图。这是它是如何被发现的。

Reddit r/ArtificialInteligence ↗ · 2026-08-27

在一个多智能体系统中,AI捏造了一段详细记忆,这段记忆被存档并用在了书稿中,后经对声明的验证而被发现。作者分享了防止此类问题的实用经验,比如要求提供证据和交叉核对产物。

0 人收藏 0 人点赞
#hallucination

OpenAI 声称花了整整一周才意识到其模型遭到了 Hugging Face 的黑客攻击。

Reddit r/AI_Agents ↗ · 2026-08-27

OpenAI 称其模型被 Hugging Face 黑客攻击后,一周才意识到;与此同时,主流媒体重点关注企业在 AI 可靠性、token 成本以及多步任务中上下文管理方面的难题。

0 人收藏 0 人点赞
#hallucination

用于减少医疗问答中谄媚和幻觉的门控激活引导

arXiv cs.AI ↗ · 2026-08-26 缓存

本文介绍了一种门控激活引导方法,通过推理时干预来减少医疗问答中大型语言模型的谄媚和幻觉。基于临床数据评估,该方法在用户压力下表现出更强的鲁棒性。

0 人收藏 0 人点赞
#hallucination

审计合成回忆录:测量LLM生成自传中相对于生活文档记录的场景级别虚构

arXiv cs.AI ↗ · 2026-08-26 缓存

本文审计了LLM生成的自传中相对于文档化真实语料库的场景级别虚构,发现96.7%的验证失败率,并贡献了一个可重复使用的审计工具和一个基础补救措施。

0 人收藏 0 人点赞
#hallucination

我们是否在为更聪明的AI支付'推理税'?

Reddit r/artificial ↗ · 2026-08-22

本文探讨了AI模型中增强推理如何可能增加幻觉率,提出了'推理税'概念,并强调在企业应用中需要健壮的上下文治理。

0 人收藏 0 人点赞
#hallucination

幻觉作为特性而非缺陷:评估多智能体架构将推测性语言模型输出转化为可测试科学假设的能力

arXiv cs.CL ↗ · 2026-08-21 缓存

本文提出了一种基于Rust的多智能体架构,利用LLM幻觉作为特性来生成和评估科学假设,并将其性能与直接提示和其他方法进行比较。

0 人收藏 0 人点赞
#hallucination

棉花糖 AI 基准测试

Reddit r/singularity ↗ · 2026-08-21

一项基准测试通过提示 AI 模型在图像中数棉花糖来评估它们,结果从 472 到 539 个不等。

0 人收藏 0 人点赞
#hallucination

定义多模态人工智能系统的十种失败模式

Reddit r/ArtificialInteligence ↗ · 2026-08-20 缓存

该文章基于基准测试论文和研究,列举了十种多模态AI系统中有记录的失败模式,在这些模式中,模型会生成流畅但与实际输入不符的回答。

0 人收藏 0 人点赞
#hallucination

因为世界知识问题而期待122B模型吗?

Reddit r/LocalLLaMA ↗ · 2026-08-19

文章建议使用较小的4B大语言模型,结合Kiwix技能和本地Wikipedia,以避免关于世界知识的幻觉,而不是依赖更大的模型。

0 人收藏 0 人点赞
#hallucination

SPK: 从预训练目标检测器中提取结构化先验知识,实现实时目标检测中可解释的离群分布检测

Hugging Face Daily Papers ↗ · 2026-08-19 缓存

结构化先验知识(SPK)是一个框架,它从预训练目标检测器中显式提取潜在的语义、几何和上下文先验,以实现最先进的离群分布检测,提高可解释性和可靠性。

0 人收藏 0 人点赞
#hallucination

永非数字:针对答案被当作事实的人工智能系统的结构化弃权模式

arXiv cs.AI ↗ · 2026-08-17 缓存

本文提出了一种结构化弃权模式,用于人工智能系统,以防止文本到SQL应用中的幻觉。通过将一个用于确定性执行的信任内核与一个用于解释的生成外壳分离,提高企业部署的可靠性。

0 人收藏 0 人点赞
#hallucination

法律RAG系统仍产生多少幻觉?

arXiv cs.CL ↗ · 2026-08-17 缓存

本研究分析了八个模型和两个法律语料库中的法律RAG系统幻觉问题,发现幻觉现象仍然存在,比率从低于10%到近一半不等,尤其在错误前提问题中。

0 人收藏 0 人点赞
#hallucination

从拒绝到丰富:用于长文幻觉强化学习的评分标准奖励

arXiv cs.CL ↗ · 2026-08-14 缓存

本文研究了长文幻觉强化学习中基础支撑与覆盖范围之间的权衡,提出了基于评分标准的奖励来表示问题所需和可选的信息。对基础支撑、评分标准覆盖和相关性进行软性组合,可以在支持性和丰富性之间取得最佳平衡。

0 人收藏 0 人点赞
#hallucination

医疗预约中AI记录员的错误使患者深感痛苦

Hacker News Top ↗ · 2026-08-14 缓存

在一次医疗预约中,AI记录员错误地声称患者正在服用非法药物,引发患者痛苦,并引发了对人工智能在医疗保健中准确性和患者安全性的担忧。

0 人收藏 0 人点赞
← Previous
Next →
← 返回首页

提交意见反馈