web-automation

标签

Cards List
#web-automation

Cloudflare推出Kitesurf,一款专为AI智能体打造的浏览器

TechCrunch AI · 4天前 缓存

Cloudflare推出Kitesurf,这是一款专为AI智能体打造的云托管浏览器,使开发者无需构建浏览器软件即可自动化网页导航和任务——现已在Browser Run平台上免费提供测试版。

0 人收藏 0 人点赞
#web-automation

@CycleDecoded: 一个叫 WebRover 的开源 AI Agent,你给它一句话,它自己打开浏览器、识别网页元素、点击、翻页、抓数据、搞定任务,最后把你要的结果整理得明明白白。 开源协议:MIT License 定位:自主式 Web 自动化 AI 智能体…

X AI KOLs Timeline · 2026-08-04 缓存

WebRover 是一个基于 MIT 协议的开源 AI Agent,通过自然语言即可驱动浏览器完成网页自动化、跨站数据抓取与深度研究,支持本地部署。

0 人收藏 0 人点赞
#web-automation

Rindler

Product Hunt · 2026-08-03

Rindler 是一款可自动完成团队目前手动执行的网络工作的产品,旨在简化重复性的在线任务。

0 人收藏 0 人点赞
#web-automation

@CycleDecoded: 搞自动化和爬虫的兄弟可以把之前的方案扔了。 GitHub 上突然爆火了一个开源项目 Index(由 AI 开发者平台 Laminar 团队打造),直接把网页浏览器变成了可调用的 API。这玩意本质上是一个极度丝滑的“AI 浏览器 Agen…

X AI KOLs Timeline · 2026-08-03 缓存

Index 是一个由 Laminar 团队开发的开源 AI 浏览器 Agent,可将任何网站转化为可调用的 API,支持 Claude、Gemini 等视觉模型,在 WebVoyager 上准确率达 92%。

0 人收藏 0 人点赞
#web-automation

我构建了klura:一种让AI代理将网站任务转化为快速、可复用的能力的方法,而不是每次都重复进行相同的UI爬取

Reddit r/AI_Agents · 2026-07-24

Klura使AI代理能够将网站任务转化为可复用的能力,消除了重复进行UI爬取的需要。

0 人收藏 0 人点赞
#web-automation

@Jolyne_AI: 开源 AI 网页自动化工具:Nanobrowser。 OpenAI Operator 的开源替代方案,本地在浏览器里运行,支持多智能体协作。 免费、重视隐私、LLM 选择灵活、代码完全开源,让网页操作更智能、更高效。 GitHub:htt…

X AI KOLs Timeline · 2026-07-04 缓存

Nanobrowser 是一个开源 AI 网页自动化工具,作为 OpenAI Operator 的免费替代方案,在本地浏览器中运行,支持多智能体协作,注重隐私且 LLM 选择灵活。

0 人收藏 0 人点赞
#web-automation

@vasuman: 直到今天AI代理仍无法做到的事情:注册服务:不行 输入信用卡:不行 使用USDC按次付费,涵盖20,000多种工具:终于可以了

X AI KOLs Following · 2026-07-01 缓存

Apify和Coinbase推出了x402支持,使AI代理能够自主注册、使用USDC支付,并无需人工干预即可访问超过20,000种网络自动化工具。

0 人收藏 0 人点赞
#web-automation

@svpino: 关于你的代理如何通过x402协议自我支付的总结:1. 给代理一个任务 2. 代理找…

X AI KOLs Following · 2026-06-30 缓存

x402协议使自主代理能够通过Base上的USDC支付工具费用,Apify已与Coinbase合作,将其x402支持从2,000个工具扩展到20,000多个工具。

0 人收藏 0 人点赞
#web-automation

@PrajwalTomar_: 我曾以为我的智能体是自主的。但它们不是。我经营着5个基于AI智能体的业务。智能体可以找到任何工具。它却…

X AI KOLs Following · 2026-06-30 缓存

Apify 和 Coinbase 已将 x402 支持扩展到超过 20,000 个工具,使得 AI 智能体能够使用 Base 上的 USDC 按次自动支付运行费用,无需手动设置账户或 API 密钥。

0 人收藏 0 人点赞
#web-automation

我给LLM一个真实浏览器和一个目标,而非脚本:它会填写表单并返回结构化JSON

Reddit r/AI_Agents · 2026-06-16

一个开源代理,使用LLM控制真实浏览器填写表单并提取结构化数据,每页仅需极少的令牌。

0 人收藏 0 人点赞
#web-automation

BrowserAct

Product Hunt · 2026-06-16

BrowserAct是一款为AI代理设计的网页浏览器自动化工具,可实现自动化的网页交互。

0 人收藏 0 人点赞
#web-automation

@rohanpaul_ai: 如今的人工智能代理仍然难以通过网站上的真实人类验证检查(CAPTCHA)。该论文提出了HLL,……

X AI KOLs Following · 2026-06-13 缓存

一篇新论文介绍了HLL,这是一个用于测试AI代理在真实CAPTCHA任务上的基准,结果显示即使是最强大的代理在杂乱页面上也会失败,并且难以从错误中恢复。

0 人收藏 0 人点赞
#web-automation

SKILL.nb: 选择性形式化与门控执行用于持久化智能体工作流

arXiv cs.AI · 2026-06-09 缓存

介绍了SKILL.nb,一个通过证据校准的生命周期策略来管理可复用智能体工作流的框架,具有选择性形式化和门控条件执行等特点。在网页自动化基准测试中取得了显著改进,并展示了对环境漂移的鲁棒性。

0 人收藏 0 人点赞
#web-automation

基于状态感知动态检索的Web智能体在线技能学习

arXiv cs.AI · 2026-06-04 缓存

本文提出了SGDR(State-Grounded Dynamic Retrieval,状态感知动态检索),一种面向Web智能体的在线技能学习方法,支持逐步、感知当前状态的技能复用,而非静态的任务级检索。在WebArena上的实验表明,SGDR结合GPT-4.1可达到37.5%的成功率,相较于强基线取得了约10.6%的相对提升。

0 人收藏 0 人点赞
#web-automation

@quanruzhuoxiu: 经常被问:Midscene 和 Browser-Use 有什么区别? 都是开源,都用视觉,都解决各自该解决的问题。下面是诚实对比,不是踩 Browser-Use。 Browser-Use 是个 web agent,定位是「打开浏览器,把这…

X AI KOLs Timeline · 2026-06-01 缓存

A comparison of Midscene and Browser-Use, two open-source tools with different focuses: Browser-Use is a web agent for one-time tasks, while Midscene is a vision SDK designed for reliable multi-platform repeated execution.

0 人收藏 0 人点赞
#web-automation

在真实网页任务中测试浏览器智能体后,我认为我们责怪模型找错了问题

Reddit r/AI_Agents · 2026-06-01

作者认为,AI智能体在真实网页任务中失败并非因为模型能力弱,而是因为浏览器是为人类设计的,缺乏供智能体使用的隔离、可编程工作空间。

0 人收藏 0 人点赞
#web-automation

构建了一个让AI代理浏览网页的Playwright版本

Reddit r/AI_Agents · 2026-05-22

这是Playwright的一个分支,每次会话生成唯一的浏览器指纹,使AI代理能够在网上不被察觉地浏览。该项目完全开源,基于MIT许可证。

0 人收藏 0 人点赞
#web-automation

Browse.sh

Product Hunt · 2026-05-21

Browse.sh 是一款为AI代理提供网络任务自动化操作记忆的工具。

0 人收藏 0 人点赞
#web-automation

@GithubProjects: Mini Browser 是一个面向AI代理的浏览器命令行工具。它让AI代理能够导航页面、抓取文本、截图、点击、填…

X AI KOLs Timeline · 2026-05-14 缓存

Mini Browser 是一个面向AI代理的浏览器命令行工具,它允许AI代理通过类Unix命令控制浏览器,实现导航、抓取、截图、填写表单等操作。

0 人收藏 0 人点赞
#web-automation

我认为很多人低估了不可靠 Agent 的成本有多高

Reddit r/AI_Agents · 2026-05-11

作者指出,不可靠 AI Agent 的隐性成本在于持续人工监控所带来的认知开销,并强调在实际落地中,可预测性与环境稳定性远比模型的原始智能更重要。当 Agent 运行在受控且经过验证的环境中,而非充满不确定性的环境时,实际工作流的效率将得到显著提升。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈