人们认为AI代理已经准备好、但实际上并非如此的任务是什么?

Reddit r/artificial 新闻

摘要

讨论那些人们认为AI代理已经准备好、但实际上并未准备好的任务,重点突出了解读模棱两可的人类输入(例如恼怒但未明确说明的消息)的挑战。

有一小部分用例在演示和演示文稿中被反复推销,但一当你真正尝试运行它们时,就完全崩溃了。对我来说,任何涉及从模棱两可的人类输入中解读意图的内容都符合这种情况。如果给AI一个清晰的工单,一切都会很好。但如果给它的消息里,对方明显很恼火但没说为什么,AI要么反应过度,要么完全没理解。对你来说,这些用例是什么?而且不一定非得是什么重大戏剧性的失败案例。即使是小小的“也许”案例也值得一听。
查看原文

相似文章