LLM的未来发展方向

Reddit r/artificial 新闻

摘要

文章讨论了为何LLM无法从用户交互中学习,且缺乏确定性的真值层,提出动态知识图谱可以减少幻觉并在医学等高风险领域提升性能。

AI模型只能在批量训练过程中学习,而不能从与用户的日常交互中学习。会话记忆并不等同于真正的学习。这些系统中也不存在核心的“真值”层:没有确定性的主干,没有对概念的真正理解,也没有可供引用、交叉检查或更新的显式词典或知识库。动态知识图谱在很大程度上可以帮助解决这些问题。它可以减少幻觉,并提升在医学、法律、物理学和化学等高风险领域的性能。它还可以减少复杂LLM所需的向量嵌入数量。您同意吗?或者是否有更好的前进道路?
查看原文

相似文章

理解LLM中新知识诱导的事实幻觉:分析与解释

arXiv cs.CL

本论文探究了在新知识上微调LLM如何诱导事实幻觉,研究表明特定知识类型内的陌生性通过削弱对关键实体的注意力来驱动幻觉。作者提议通过在后期训练阶段重新引入已知知识来缓解这一问题。

LLMs 并非你所认为的黑箱

Hacker News Top

一篇总结 Anthropic 2025 年关于机制可解释性论文的文章,表明 LLM 并非黑箱,电路追踪可以揭示多步推理和人类可识别的概念。