构建AI:错误不容有失
摘要
本文反思了在鹿特丹一家社会组织的志愿者中构建本地部署AI聊天机器人的经历,强调当AI错误带来实际后果时(例如向无家可归者提供过时的庇护所信息),其设计与工程方法必须与低风险场景有根本不同。
值得信赖的AI不会取代关怀,而是减少提供关怀的摩擦。你是否用过Spotify的DJ功能?它会挑选你已经喜欢的歌曲,用友好的声音包装起来,创造出一种算法*懂你*的愉快错觉。然后,当你提出具体要求,比如一个小众流派或特定的心情时,面具就会滑落。它会播放完全不对的东西,或者直接无视你。当然,只是有点烦人。你跳过这首歌,继续你的一天。现在想象一种不同的错误答案。一个聊天机器人告诉一位无家可归者,某个夜间庇护所还开着,但实际上它两小时前就关门了。或者它自信地推荐一个上个月已经搬走的食品分发点。这个人走过去,什么也没找到,整晚没有食物和床。这不是跳过一首歌。这是将真实的后果落在真实的人身上。在我攻读应用数据科学与AI期间,我主导了一个项目,探索一个本地部署的小型AI聊天机器人是否能为鹿特丹一家基于教堂的社会组织的前线志愿者提供支持。访客们,其中许多是无家可归者,带着关于庇护所、食物、基本法律文件、转介和当地服务的实际问题而来。志愿者们需要快速获取可靠答案,同时往往还要处理情感对话、有限的时间以及无法简单归类为常见问题的情境。我们并非试图自动化关怀。我们试图减少信息摩擦,以便志愿者可以花更少的时间搜索,更多的时间真正提供帮助。但这个项目教会了我一些当初并未完全认识到的东西:在错误至关重要的背景下构建AI,与在错误无关紧要的背景下构建AI,有着本质区别。这篇博客正是关于这些区别,以及它们所要求的工程和设计决策。完整博客文章见下方的我的Substack。
相似文章
当你的AI功能出现细微错误时,你如何处理用户信任?用户会像原谅自动更正那样原谅它,还是它会侵蚀整个应用?
探讨了为什么AI功能出错时往往失去用户信任,而自动更正却能被原谅。指出了关键因素如置信度框架、可逆性和失败可见性,并提出了维护信任的设计方法。
当AI代理造成重大失误时,谁该承担责任?
本文探讨了当AI代理犯下代价高昂的错误时的责任归属问题,分析了开发者、用户和监管机构在法律和伦理方面的影响。
AI安全的另一半
文章批评AI安全领域专注于灾难性风险,却忽视了像ChatGPT这样的聊天机器人对日常心理健康的危害。引用OpenAI自身数据,数百万用户表现出精神病、躁狂或自杀意念的迹象,却仅被重定向,未进行硬性拦截。
大多数AI智能体失败的原因在于人们像构建聊天机器人那样构建它们
许多AI智能体实现失败是因为它们把智能体当作聊天机器人来对待,依赖聊天历史记录来管理状态,而非使用确定性的数据结构。文章提倡将推理(LLM)、动作(工具)、工作流进度(状态机)和外部触发(网络钩子)分开,以构建可靠的业务智能体。
2026年,憎恨AI
对AI行业的环境成本及聊天机器人能力的过度宣传的批判性反思,指出许多危害被忽视,并且不使用AI仍然是一个轻松的选择。