AI代理的自动化级别(0-4)——你的代理处于哪个级别?
摘要
作者提出了一个基于自主性的0-4级框架来分类AI代理,借鉴了他们在构建代理基础设施方面的经验,并质疑社区当前的实现方式。
我构建代理已经有一段时间了,我不断看到“代理”这个词被用于非常不同的事物,所以我开始按级别思考,类似于自动驾驶级别。以下是我使用的思维模型:
- 级别0 - 无AI。脚本、定时任务、CI。流程已知、确定。如果你能事先写下步骤,直接编码即可。
- 级别1 - AI在环。Copilot、补全、分类/提取/摘要。你在驾驶,AI提供建议。很多被称为代理的东西实际上在这里——一个非常智能的函数,无自主性。
- 级别2 - AI在你的电脑上。带有终端和文件系统的编码代理。AI驾驶,你监督,手放在ctrl-z附近。适用于实际工作,但无法扩展到产品,因为每个用户都需要监督。
- 级别3 - AI有自己的电脑。每个任务一个临时虚拟机,你通过聊天像同事一样与它对话。你委派任务然后离开,它在完成/遇到困难/需要决策时发消息给你。密钥在网络层注入,运行时可丢弃。
- 级别4 - 多个级别3的代理协调,常规操作中无人类参与。
对我来说改变一切的跳跃是从2到3:将代理视为一个你发消息的团队成员,而不是一个需要监控的进程。
披露:我构建代理基础设施,所以这里有偏见。好奇其他人如何看待——你当前的代理处于哪个级别?当你尝试从2级移动到3级时,什么会出问题?
相似文章
AI 用户的 7 个等级(以及如何进阶)
本文提出了一个 7 级的 AI 用户熟练度框架,从基础的搜索替代到构建自主智能体系统。文章提供了在每个阶段进阶的策略,例如语境工程和多工具集成。
@s4yonnara: 你使用AI代理的方式还停留在2024年。有5个层次,大多数人从未离开过第一层。Boris Cherny,创作者…
Boris Cherny,Claude Code的创建者,概述了AI代理使用的五个层次,从基本提示到自主启动和学习的自主代理,关键洞察是代理本身是任务完成情况的最差评判者。
关于AI代理自主性,你究竟在哪里划定界限?
一篇反思性文章,质疑AI代理自主性的界限应划在哪里,讨论了各种行动的风险级别,以及某些决策是否仍必须经过人工批准。
你能将多少任务委托给智能代理?(7分钟阅读)
文章提出了一个框架,用于根据两个因素决定给予AI代理多少自主权:检查输出的难易度和撤销错误的难易度。它介绍了四种委托级别,从代理作为助手到完全自动驾驶模式,并用决策树进行了说明。
我不再将AI代理的自主性视为单一开关
作者主张将AI代理的自主性视为多个权限级别而非单一开关,强调了读取文件、做决策等不同操作以避免过度授权,并征求他人如何决定自主操作的意见。