当浏览器代理使用你的日常 Chrome 配置文件时,应如何展现控制权?

Reddit r/AI_Agents 工具

摘要

作者分享了 Panerelay 的设计决策,这是一个开源项目,允许 AI 代理控制真实的 Chrome 配置文件,将权限(如站点访问、标签页选择和控制租约)分离,并征求社区对授权边界的反馈。

我希望 AI 代理能在我已经在使用的浏览器会话中工作,但直接通过 CDP 连接让一个问题的规格显得不明确:授权。浏览器可以授予站点访问权限、选择标签页并持有自动化连接,但这些是不同的决策。在实现中,我最终将权限分离为:站点权限、显式的标签页授权、用于变更的独占控制租约、可见的受控状态、即时撤销。代理可以在已授权的标签页之间进行选择,而无需切换当前用户正在查看的标签页。手动浏览仍然属于用户本人,聚焦不会赋予代理更多权限。我将此构建到一个名为 Panerelay 的开源项目中,所以这并非纯粹的理论问题。我是作者。我不确定的是,这种边界对其他代理用户来说是否直观。你更倾向于每次标签页、每次来源(origin)还是每次代理会话批准一次访问?当用户手动与页面交互时,代理控制应该如何处理?
查看原文

相似文章

智能体是新的浏览器

Reddit r/AI_Agents

作者认为,SaaS 公司不应该构建自己的智能体来控制 API 的用户体验,这就像为了控制网站用户体验而去分叉 Chrome 一样;他们应该专注于数据收集,让智能体来处理呈现和查询。