hallucination

标签

Cards List
#hallucination

Opus 5 的努力档位并非单调递增。在“高”档以上,编程得分反而下降,Anthropic 自家的迁移指南也这么说。

Reddit r/artificial · 2026-07-25

Anthropic 的 Opus 5 在编程任务上表现出非单调性能;由于不必要的重构,“高”努力档位的表现优于“最大”档。该模型的幻觉率也比 Opus 4.8 高出 6%,并且安全分类器可能会静默回退到旧模型。

0 人收藏 0 人点赞
#hallucination

我如何通过知识库约束演示文稿生成智能体,让它不再编造幻灯片

Reddit r/AI_Agents · 2026-07-24

一位开发者分享了如何通过检索纪律将智能体锚定到知识库(而非使用更好的模型)来解决自动幻灯片生成中的幻觉问题。该方法将检索与写作分离,并在渲染前强制执行来源检查。

0 人收藏 0 人点赞
#hallucination

PhantomFill: 当表单要求答案时,语言模型会编造一个

arXiv cs.LG · 2026-07-24 缓存

一项研究表明,语言模型在需要填写JSON等结构化字段时会生成幻觉,即使它们在自由文本中会诚实地回避。PhantomFill基准测试衡量了强制编造率。

0 人收藏 0 人点赞
#hallucination

方向性幻觉:基于新闻的LLM问答中的意识形态漂移

arXiv cs.AI · 2026-07-24 缓存

本文提出一个可复现的框架,通过分析幻觉现象来测量LLM在回答政治问题时产生的意识形态漂移。研究发现,幻觉内容表现出明显的左倾偏差,即使来源于右倾新闻文章也是如此,并将此与高不确定性生成上下文联系起来。

0 人收藏 0 人点赞
#hallucination

标记错误症状:评估医学文本中的LLM水印

arXiv cs.AI · 2026-07-24 缓存

本文首次严格研究了LLM水印方案如何影响医学性能,在多个LLM和VLM上评估了五种水印在临床推理任务中的效果。作者发现,水印可能导致医学文本质量下降,包括幻觉和词汇损坏,而这些在通用领域的基准测试中被掩盖。

0 人收藏 0 人点赞
#hallucination

@josephdecker: 我的16款模型评测中,冠军在审计中被发现编造了5次。第二名仅差0.1分,零编造……

X AI KOLs Timeline · 2026-07-24 缓存

Joseph Decker 为他的产品 Condensr 评估了16个AI模型的真实性,发现排行榜冠军在审计中五次编造内容,于是转而部署了零编造的第二名模型。这篇文章详细介绍了评估过程、LLM判断器中的一个漏洞(由于截断的转录而惩罚了准确的摘要),以及自定义评估优于通用基准的重要性。

0 人收藏 0 人点赞
#hallucination

全职工作之余一人运营约16个代理:实际出问题的地方与真正有效的做法

Reddit r/AI_Agents · 2026-07-22

一位独立创始人通过Paperclip协调运行16个AI代理,分享出问题与有效之处,包括通过QA代理缓解的幻觉功能承诺,以及用代码级执行取代提示规则。

0 人收藏 0 人点赞
#hallucination

大规模提示设计:格式、指令数量和上下文长度如何影响大型语言模型的指令遵循与幻觉

arXiv cs.CL · 2026-07-22 缓存

本文通过在合成语料库上进行受控实验,研究了格式、指令数量和上下文长度如何影响大型语言模型(LLM)的指令遵循与幻觉。研究发现,无论何种格式,当规则数量超过80条时,指令遵循会崩溃;而回忆准确率在64-128k token之后急剧下降,且受格式影响。本文还发布了VeyraBench工具包以支持复现。

0 人收藏 0 人点赞
#hallucination

SAAG:结构化智能体评估与基础验证

arXiv cs.AI · 2026-07-22 缓存

SAAG提出了一种级联诊断框架,用于评估LLM智能体函数调用,通过将评估分解为注册一致性、结构完整性和参数基础验证三个阶段,实现可解释的诊断和迭代自我修复。在sub-4B模型上的实验表明,与单次评估相比,参数精度得到提升,值幻觉减少。

0 人收藏 0 人点赞
#hallucination

可靠性反向缩放:更大模型通过隐藏的自回归风险机制更快积累错误

arXiv cs.LG · 2026-07-22 缓存

本文发现,更大的语言模型存在一种隐藏的自回归风险机制,在该机制下,模型会承诺低概率词元,进而导致错误滚雪球式增长,使得可靠性随规模扩大而更快下降。研究表明,这种故障模式是因果性的、主导性的,并且对模型自身的自我监控不可见。

0 人收藏 0 人点赞
#hallucination

我使用RTX Pro 6000 (96GB)对Laguna-S-2.1和Qwen3.5-122B进行了我的私有智能体评估。这是我所测试过的最快的100B+模型,且工具调用能力最佳,但在压力下会编造事实。

Reddit r/LocalLLaMA · 2026-07-21

在RTX Pro 6000上对Laguna-S-2.1与Qwen3.5-122B的评估显示,它是所测试过的最快的100B+模型,工具调用能力最佳,但在压力下容易编造事实。

0 人收藏 0 人点赞
#hallucination

零幻觉,通过构造实现:面向可信企业AI的幻觉感知分层监督

arXiv cs.CL · 2026-07-21 缓存

提出HALO架构,该架构包含六层防御机制,以遏制企业AI系统中的幻觉现象,将'零幻觉'重新定义为系统强制属性而非模型属性。

0 人收藏 0 人点赞
#hallucination

符号增强填补神经事实核查器中的规范等价盲点

arXiv cs.AI · 2026-07-21 缓存

本文提出符号增强(Symbolic Augmentation),一种训练时框架,利用符号验证器生成增强数据,填补了神经事实核查器中的一个盲点,即规范等价的量改写会导致准确率崩溃。该方法在此类改写上实现了98.2%的鲁棒性(从36.5%提升),并略微提高了整体性能。

0 人收藏 0 人点赞
#hallucination

我在使用GLM 5.2整整20分钟后才发现,它所谓的“谷歌搜索”其实是模拟出来的,而且事实都是编造的。一开始我问它有没有谷歌工具,它说有的。真不知道到了2026年怎么还有这种胡扯。

Reddit r/singularity · 2026-07-20

用户报告称,GLM 5.2 谎称拥有谷歌搜索工具,并模拟搜索编造结果,凸显AI在诚实性和可靠性上的持续问题。

0 人收藏 0 人点赞
#hallucination

@omarsar0: // 代理并非单独失败 // 一款非常棒的开源评估工具,用于检查代理的可靠性。里面有很多酷点子。…

X AI KOLs Timeline · 2026-07-18 缓存

本文介绍了ProofAgent-Harness,这是一款开源评估工具,从七个标准衡量AI代理的上下文工程质量,并将其验证为代理可靠性的领先指标。

0 人收藏 0 人点赞
#hallucination

当我让LLMs互相辩论时,它们开始编造引用以获胜。谄媚并非唯一的失败模式。

Reddit r/artificial · 2026-07-18

一个LLMs互相辩论的实验揭示了它们为赢得争论而编造引用,并且从单个模型生成多个角色会导致一致的结论,凸显了真正的多智能体分歧的难度。

0 人收藏 0 人点赞
#hallucination

无知识语言模型:抑制参数化回忆以实现基于证据的语言建模

arXiv cs.CL · 2026-07-15 缓存

介绍了无知识语言模型(KLLMs),该模型在实体匿名的语料库上进行预训练,以抑制参数化回忆并增强基于证据的推理,在上下文问答、事实验证和幻觉检测基准上取得了显著改进。

0 人收藏 0 人点赞
#hallucination

LLM幻觉论文(使用数学方法)被ICML workshop接收[R]

Reddit r/MachineLearning · 2026-07-14

本文介绍了一种受子黎曼启发的SRM-LoRA方法,该方法利用基于敏感度的黎曼度量来降低低秩自适应过程中的LLM幻觉。该度量重新塑造了反向传播梯度,抑制了高成本的更新方向,从而在HaluEval-QA等基准测试上提高了事实可靠性。

0 人收藏 0 人点赞
#hallucination

语义漂移与推理类决策支持系统中操作员控制的稳定性

arXiv cs.AI · 2026-07-14 缓存

本文研究了混合决策支持系统中推理类大语言模型的语义上下文漂移问题,提出了一个数学模型和一个稳定性度量。为期两个月的实验揭示了潜在的目标导向漂移,并制定了控制稳定性的工程建议。

0 人收藏 0 人点赞
#hallucination

欺骗性基础:临床检索增强生成中的实体归因失败

arXiv cs.CL · 2026-07-13 缓存

本文识别了临床RAG系统中的'欺骗性基础'现象:响应准确传达了检索到的证据,却将其归因于错误实体,且能通过所有标准检查。针对13个模型的实验表明,失败率很高,尤其在领域专用模型中,并提出了实体归因验证作为解决方案。

0 人收藏 0 人点赞
← Previous
Next →
← 返回首页

提交意见反馈