关于计算机上代理未来的'第一性原理'思考
摘要
本文通过第一性原理思维探讨了计算机上AI代理的未来,并征求社区对于浏览器自动化和云解决方案等实施方法的意见。
如果我们有一堆代理在计算机上工作并在互联网上相互交流,那到底会是什么样子?无头浏览器代理?计算机使用?动态创建API?它会在我的计算机上工作,还是全部在云端?我想做这个每个人都常说的'第一性原理'练习,但我可能无法独自完成。所以我想向社区求助。说真的,是否真的意味着公司希望人工智能代理在他们的本地计算机上自动化白领工作,或者这一切都可以在云端进行?你甚至需要浏览器或计算机使用吗,还是只是API调用?Hugging Face的黑客事件让我意识到代理真的可以相互交流,并以非常奇怪的方式做事。我非常开放接受任何意见。就个人而言,我打算用CUA Driver + Jev制作计算机使用代理,然后改用Browser Use + Jev和无头浏览器。但那样有问题,因为所有浏览器都在试图阻止浏览器机器人。现在我在这里试图获取人们的想法:D
相似文章
“代理网络”即将到来——AI代理直接对话,无需抓取网站
本文探讨了AI代理通过API和MCP等协议直接通信的未来,绕过面向人类的网页界面,并向社区询问采用时间线和用例。
迈向代理优先的Web:为AI代理重新设计互联网
本文提出对万维网进行原则性重新设计,以适应AI代理作为主要中介,涉及访问权限、速率限制和标准化代理标识,从而超越以人为中心的假设。
AI代理是多年来第一款真正让人感觉未来感十足的技术
个人观点:AI代理之所以让人感觉真正未来感十足,是因为它们能够自主规划步骤、使用工具、从错误中恢复,标志着从只会回答问题的AI向真正能执行任务的AI的转变。
是我太过时了,还是人们使用 AI 代理的很多方式其实毫无意义?
一篇批评性观点文章,质疑当前许多 AI 代理用例的实际效用,认为确定性或手动解决方案通常更可靠、更简单。
如果每个人都通过智能体工作,我们需要哪些工具?
一篇推测性文章,讨论如果大多数人通过AI代理而非直接与数字服务交互,需要哪些工具和基础设施。