构建AI:错误不容有失
摘要
本文反思了在鹿特丹一家社会组织的志愿者中构建本地部署AI聊天机器人的经历,强调当AI错误带来实际后果时(例如向无家可归者提供过时的庇护所信息),其设计与工程方法必须与低风险场景有根本不同。
值得信赖的AI不会取代关怀,而是减少提供关怀的摩擦。你是否用过Spotify的DJ功能?它会挑选你已经喜欢的歌曲,用友好的声音包装起来,创造出一种算法*懂你*的愉快错觉。然后,当你提出具体要求,比如一个小众流派或特定的心情时,面具就会滑落。它会播放完全不对的东西,或者直接无视你。当然,只是有点烦人。你跳过这首歌,继续你的一天。现在想象一种不同的错误答案。一个聊天机器人告诉一位无家可归者,某个夜间庇护所还开着,但实际上它两小时前就关门了。或者它自信地推荐一个上个月已经搬走的食品分发点。这个人走过去,什么也没找到,整晚没有食物和床。这不是跳过一首歌。这是将真实的后果落在真实的人身上。在我攻读应用数据科学与AI期间,我主导了一个项目,探索一个本地部署的小型AI聊天机器人是否能为鹿特丹一家基于教堂的社会组织的前线志愿者提供支持。访客们,其中许多是无家可归者,带着关于庇护所、食物、基本法律文件、转介和当地服务的实际问题而来。志愿者们需要快速获取可靠答案,同时往往还要处理情感对话、有限的时间以及无法简单归类为常见问题的情境。我们并非试图自动化关怀。我们试图减少信息摩擦,以便志愿者可以花更少的时间搜索,更多的时间真正提供帮助。但这个项目教会了我一些当初并未完全认识到的东西:在错误至关重要的背景下构建AI,与在错误无关紧要的背景下构建AI,有着本质区别。这篇博客正是关于这些区别,以及它们所要求的工程和设计决策。完整博客文章见下方的我的Substack。
相似文章
当你的AI功能出现细微错误时,你如何处理用户信任?用户会像原谅自动更正那样原谅它,还是它会侵蚀整个应用?
探讨了为什么AI功能出错时往往失去用户信任,而自动更正却能被原谅。指出了关键因素如置信度框架、可逆性和失败可见性,并提出了维护信任的设计方法。
我曾以为AI智能体在于工具,但我错了
一篇关于构建AI智能体的反思文章,指出核心挑战并非工具,而是设计人机之间的边界、信任与故障模式。
当AI代理造成重大失误时,谁该承担责任?
本文探讨了当AI代理犯下代价高昂的错误时的责任归属问题,分析了开发者、用户和监管机构在法律和伦理方面的影响。
构建智能体让我明白,模型很少是问题所在。你有哪些来之不易的教训?
一位开发者分享了构建AI智能体的来之不易的教训:优先关注工具设计而非模型选择,使用小循环而非大型提示,记录智能体上下文,尽早添加防护措施,以及创建小型评估来捕捉错误。
真实用户出现后,AI代理的构建变得奇怪起来
一位经验丰富的开发者反思了AI代理演示与实际性能之间的差距,强调了诸如文档不完善、权限期望过于简单,以及认为概率性软件在生产中会变得确定性的误解等问题。