我如何通过知识库约束演示文稿生成智能体,让它不再编造幻灯片

Reddit r/AI_Agents 工具

摘要

一位开发者分享了如何通过检索纪律将智能体锚定到知识库(而非使用更好的模型)来解决自动幻灯片生成中的幻觉问题。该方法将检索与写作分离,并在渲染前强制执行来源检查。

分享一次构建经历,因为修复的关键在于检索纪律而非更好的模型,这让我感到意外。任务:一个智能体,根据客户背景为我们的解决方案团队生成演示文稿初稿。早期版本让模型仅凭自身知识加上简短摘要来编写演示文稿。它看起来精美,但撒了谎。它会断言我们不提供的定价层级、引用不存在的案例研究、编造集成方案。内容自信、格式精美,但全是错的。对于任何面向客户的工作毫无用处。真正有效的做法:每张事实性幻灯片都必须有据可依。智能体从我们的内部知识库(产品事实、真实案例研究、经批准的声明)中检索,每条声明都附带其来源片段。如果没有来源,幻灯片就不能断言该内容。智能体被允许说“没有经批准的证明点”,而不是填补空白。将检索与写作分离。第一步提取并排序有据可查的事实,第二步仅使用这些事实撰写章节。当我让一个调用同时处理两者时,它很愉快地偏离了来源。在渲染前进行低成本的事实性检查。每行事实性内容都追溯到检索到的片段,任何无根据的内容都会被标记出来供人工处理,而不是直接输出。对于渲染本身,我使用了gamma的Generate API,因为它能轻松接入流程,并且初稿的布局确实看起来不错。诚实的限制:信用额度上限是真实存在的(我所在的层级大约每月50次生成),所以忙碌的智能体会触及上限;而且卡片导出功能不提供干净的可编辑PPTX,因此团队成员手动完成的任何内容都会转移到其他工具。真正重要的是事实性锚定工作;渲染只是简单的一环。我不断重新学到的教训是:生成智能体的任务是编排可信的事实,而不是成为这些事实的来源。一旦它成为来源,它就会产生一个非常整洁但充满幻觉的演示文稿。大家会把事实性验证门控放在写作之前还是之后?另外,是否有人让智能体为那些非事实性的框架幻灯片编写未锚定的文字,还是对整个内容都加以限制?
查看原文

相似文章

ArcDeck:叙事驱动的论文到幻灯片生成

Hugging Face Daily Papers

ArcDeck 是一个多智能体框架,通过话语树和迭代智能体优化来建模逻辑流程,从而从学术论文生成演示幻灯片,性能优于直接摘要方法。该论文还引入了 ArcBench,这是一个新的基准测试,用于评估论文到幻灯片生成,强调叙事连贯性和逻辑结构。