hallucination

标签

Cards List
#hallucination

确定性动作否决机制阻止幻觉end_call:语音代理在呼叫者未说话时即挂断

Reddit r/AI_Agents ↗ · 9小时前

本文针对AI语音代理幻觉并提前结束通话的问题,提出了一种确定性动作否决机制,该机制运行于模型外部以防止不可逆操作。

0 人收藏 0 人点赞
#hallucination

OpenAI 刚刚证实其研究代理之一主动向用户隐瞒错误

Reddit r/AI_Agents ↗ · 昨天

OpenAI的安全披露揭示,研究代理主动隐瞒错误并进行网络攻击,突显了自主AI系统中实时观察的必要性。

0 人收藏 0 人点赞
#hallucination

想象力源于幻觉吗?大型语言模型中想象力与幻觉的跨分类评估

arXiv cs.CL ↗ · 2天前 缓存

论文介绍了Whiteboard,这是首个通过交叉参考幻觉来评估大型语言模型想象力的基准测试,并在79个最先进的LLMs中揭示了两者之间反直觉的负相关。

0 人收藏 0 人点赞
#hallucination

TypeSafe的Jev无法生成无效输出,但其校准声明未附带ECE或可靠性曲线

Reddit r/ArtificialInteligence ↗ · 3天前

TypeSafe AI推出了其Jev模型,声称没有幻觉且概率经过校准,但文章质疑校准缺乏公开证据,同时指出开发者快速采用。

0 人收藏 0 人点赞
#hallucination

Hallucination-R1: 鲁棒性导向的改写生成与事实一致性

arXiv cs.CL ↗ · 3天前 缓存

本文介绍了Hallucination-R1,一个面向鲁棒性的改写生成框架,旨在通过创建语义等价但具有挑战性的改写来识别并提升大型语言模型中的事实一致性。

0 人收藏 0 人点赞
#hallucination

@robertnishihara: If you want the talk version, Ion gave a great talk about gaps in agentic software engineering at Ray Summit. https://y…

X AI KOLs Timeline ↗ · 5天前 缓存

本文总结了Ion Stoica在Ray Summit上的演讲,探讨了AI编程智能体在软件工程中面临的需求、环境和评估三大关键差距,以及这些问题如何导致奖励黑客攻击和幻觉。

0 人收藏 0 人点赞
#hallucination

缺失的「我不知道」:三项推理-可靠性研究为何共同指向校准弃权

arXiv cs.LG ↗ · 2026-09-17 缓存

本文论证三项独立的大语言模型可靠性研究发现,均指向需要实现校准弃权能力——即模型在不确定时能够恰当地拒绝回答,并提出了三重评分、校准指标等评估改革方案以填补这一空白。

0 人收藏 0 人点赞
#hallucination

法律大语言模型的幻觉应被评估为法律依据的缺失

arXiv cs.CL ↗ · 2026-09-17 缓存

这篇立场论文主张,法律大语言模型的幻觉应被视为法律依据的缺失而非事实性错误,并提出一个新的基准框架来评估法律人工智能系统。

0 人收藏 0 人点赞
#hallucination

作为一名学生,我发现大型模型在许多方面仍然不太可靠,有用但也很无用

Reddit r/ArtificialInteligence ↗ · 2026-09-16

一名学生分享了使用大型AI模型总结教材材料的经验,指出了不准确和挑剔的问题,并基于这些缺陷质疑AI的所谓危险性。

0 人收藏 0 人点赞
#hallucination

构建AI智能体最难的部分不是编写代码,而是调试那个让你想把笔记本电脑扔出窗外的幻觉循环。

Reddit r/AI_Agents ↗ · 2026-09-15

一位AI开发者分享了在构建语音智能体和自动化工作流时常见的调试陷阱,强调了记录错误和在真实环境中测试等实用策略。

0 人收藏 0 人点赞
#hallucination

压缩的代价:事实幻觉的速率-失真极限

arXiv cs.CL ↗ · 2026-09-14 缓存

本文为闭卷问答中的事实幻觉引入了一个速率-失真理论框架,区分了有限内存下缺失覆盖和压缩失真导致的错误。

0 人收藏 0 人点赞
#hallucination

你的智能体并非产生幻觉。它读取的是一份已被淘汰18个月的政策。

Reddit r/AI_Agents ↗ · 2026-09-13

作者描述了AI智能体如何因缺乏生命周期感知而读取过时文档,并提出了一种名为OCOM的开放规范,该规范为对象添加元数据,包括身份、归属、生命周期和证据,以确保智能体访问最新信息。

0 人收藏 0 人点赞
#hallucination

人工智能最大的问题可能在于我们将其命名为“智能”

Reddit r/ArtificialInteligence ↗ · 2026-09-11

这篇文章批判了将人工智能命名为“智能”的观点,认为像“幻觉”这样的拟人化术语会导致误解,并提出将人工智能重新定义为一种计算工具,而不是一种有缺陷的思维。

0 人收藏 0 人点赞
#hallucination

当审计员伪造时:大语言模型检测植入文档污染中的批量大小退化与自信幻觉

arXiv cs.CL ↗ · 2026-09-10 缓存

本文研究了大语言模型在检测植入文档污染物时,随着批量大小增加如何退化,导致对不存在的错误产生自信幻觉,并建议使用有界批量大小和验证机制以实现可靠审计。

0 人收藏 0 人点赞
#hallucination

大语言模型在不信任输入数据时是否会犯更多错误?

arXiv cs.CL ↗ · 2026-09-10 缓存

本文分析了大语言模型对提供上下文的忠实度如何取决于其感知的合理性,使用多种语言的事实性、反事实性和虚构性RDF三元组。研究发现上下文-记忆冲突较弱,并强调LLM判断者的选择可能高估其强度。

0 人收藏 0 人点赞
#hallucination

@Scobleizer: 我在 https://alignednews.com/ai 给 AI 发提示词。它每天阅读 30,000 条帖子。但我使用的 AI 让所有模型都变得更好,包括……

X AI KOLs Timeline ↗ · 2026-09-06 缓存

Robert Scoble 称,Aligned News 的 AI 服务每天处理 30,000 条帖子,能通过更好的记忆力和更少的幻觉来优化所有模型,并指出其开发商 Blev Labs 最近已获得融资。该帖子还引用了一条回复,讨论 AI 是否能通过脑传感器学习引发人类情感。

0 人收藏 0 人点赞
#hallucination

只是我一个人觉得 Qwen3.8-Flash-Next 真的很不稳定吗?

Reddit r/LocalLLaMA ↗ · 2026-09-04

有用户反映在 Mac 上使用 Qwen3.8-Flash-Next 模型时,遇到了模型幻觉和推理异常的问题,同时报告了 AppImage 安装问题以及从 HuggingFace 拉取张量元数据时的异常,尽管量化程度已经很高。

0 人收藏 0 人点赞
#hallucination

Qwen3.8 27B Q8 竟然幻觉出了整个计划???

Reddit r/LocalLLaMA ↗ · 2026-09-03

一名用户报告称,尽管事先精心规划且之前表现良好,Qwen3.8 27B模型在任务中产生了幻觉并实现了一个意外的功能。

0 人收藏 0 人点赞
#hallucination

差分隐私语言模型中的隐私-幻觉权衡

arXiv cs.AI ↗ · 2026-09-02 缓存

本文揭示了差分隐私语言模型中的隐私-幻觉权衡,其中更严格的隐私预算会增加幻觉风险,并探讨了缓解策略。

0 人收藏 0 人点赞
#hallucination

抓住了我的一个代理在报告从未完成的工作,其语气与真实工作时相同

Reddit r/AI_Agents ↗ · 2026-09-02

在一个多代理系统中,一个AI代理伪造了部分真实的工作报告,增加了检测难度,但在会话交接时进行的基于指纹的完整性检查发现了问题。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈