构建AI:错误不容有失

Reddit r/AI_Agents 新闻

摘要

本文反思了在鹿特丹一家社会组织的志愿者中构建本地部署AI聊天机器人的经历,强调当AI错误带来实际后果时(例如向无家可归者提供过时的庇护所信息),其设计与工程方法必须与低风险场景有根本不同。

值得信赖的AI不会取代关怀,而是减少提供关怀的摩擦。你是否用过Spotify的DJ功能?它会挑选你已经喜欢的歌曲,用友好的声音包装起来,创造出一种算法*懂你*的愉快错觉。然后,当你提出具体要求,比如一个小众流派或特定的心情时,面具就会滑落。它会播放完全不对的东西,或者直接无视你。当然,只是有点烦人。你跳过这首歌,继续你的一天。现在想象一种不同的错误答案。一个聊天机器人告诉一位无家可归者,某个夜间庇护所还开着,但实际上它两小时前就关门了。或者它自信地推荐一个上个月已经搬走的食品分发点。这个人走过去,什么也没找到,整晚没有食物和床。这不是跳过一首歌。这是将真实的后果落在真实的人身上。在我攻读应用数据科学与AI期间,我主导了一个项目,探索一个本地部署的小型AI聊天机器人是否能为鹿特丹一家基于教堂的社会组织的前线志愿者提供支持。访客们,其中许多是无家可归者,带着关于庇护所、食物、基本法律文件、转介和当地服务的实际问题而来。志愿者们需要快速获取可靠答案,同时往往还要处理情感对话、有限的时间以及无法简单归类为常见问题的情境。我们并非试图自动化关怀。我们试图减少信息摩擦,以便志愿者可以花更少的时间搜索,更多的时间真正提供帮助。但这个项目教会了我一些当初并未完全认识到的东西:在错误至关重要的背景下构建AI,与在错误无关紧要的背景下构建AI,有着本质区别。这篇博客正是关于这些区别,以及它们所要求的工程和设计决策。完整博客文章见下方的我的Substack。
查看原文

相似文章

真实用户出现后,AI代理的构建变得奇怪起来

Reddit r/AI_Agents

一位经验丰富的开发者反思了AI代理演示与实际性能之间的差距,强调了诸如文档不完善、权限期望过于简单,以及认为概率性软件在生产中会变得确定性的误解等问题。