@DeRonin_: 你明白 Browserbase 刚刚开源了什么吗???一个只需学习一次任何网站,就能以十分之一成本永久完成任务的智能体……

X AI KOLs Following 工具

摘要

Browserbase 开源了 Autobrowse,这是一个智能网页浏览工具,通过迭代探索学习网站结构,并将发现的模式保存为可复用的 Markdown 技能文件,大幅减少重复网页自动化任务的时间和成本。

你明白 Browserbase 刚刚开源了什么吗???一个只需学习一次任何网站,就能以十分之一成本永久完成任务的智能体 [ 它对我的实际帮助 ]: - 为新站点编写爬虫(以前每次都要花半天时间) - 网站某天突然改版后追逐选择器(因此浪费过数周) - 挖掘隐藏在网络流量中的未公开 API(之前放弃过太多次) - 向团队解释智能体是如何完成任务的(以前根本不可能) Autobrowse 通过 3-5 次迭代自行搞定了所有这些,并将答案保存为一个 Markdown 文件,下一个智能体会在开始执行任务之前读取它 [ 实际工作原理 ]: > 给智能体一个真实站点上的真实任务 > 它尝试、失败、学习、再次尝试 > 3-5 轮后,它收敛到一个可行的路径 > 将该路径写入 SKILL.md > 下一个智能体加载这个文件后直接跳到答案 Markdown 文件就是记忆 在此之前,每一个浏览器智能体都患有健忘症 ——学会了网站用法,会话一结束就忘干净 你一直重复支付相同的发现税上百次,却没有意识到 [ Karpathy 的自动研究思路,但应用于网页 ]: 同样的想法,不同的实现方式 Karpathy 用于研究和编码循环 Autobrowse 用于开放网络 新意在于: Karpathy 的循环仅在单次会话内变得更智能 Autobrowse 则将经验保存到文件中,下一个智能体在开始迭代之前就能读取 迭代 = 毕业 智能体不仅自己学会了…还为后来者留下了笔记 [ 数据对比 ]: Craigslist 爬取: - 通用智能体循环:$0.22 / 71 秒 - 毕业后的 Autobrowse 技能:$0.12 / 27 秒 表单填写任务: - 第 1 次运行:$1.40 - 第 4 次运行:$0.24 第一次运行的成本就覆盖了之后所有的开销 [ 最让我震惊的部分 ]: 他们把它指向了一个联邦资助门户 智能体四处探查,发现了一个人类多年未发现的未文档化 JSON 端点 原本 28 页的爬取内容变成了一个 fetch 请求 > 智能体尝试了人类永远不会尝试的方法 > 并发现了人类永远不会看到的东西 100% 开源,免费 我花了一整个上午深入研究它,看到 token 花费的节省时感到非常震撼——爬取 10 个网站我只花了 12 美分,而不是基本的 1.02 美元 P.S. 如果在设置时我的反应显得过于“强行”,抱歉——我只是想用粗体标记出宝藏。你可以跳过这些,这是你的选择。
查看原文

相似文章