浏览器层才是导致您的网络代理被阻止的原因,而非模型
摘要
本文解释了网络代理被阻止是由于浏览器指纹不一致,而不是模型或无头设置,并介绍了pydoll,一个使用Chrome DevTools Protocol实现无检测自动化的Python库。
因此,大多数浏览网页的代理在接触真实网站时就会被阻止,人们往往归咎于模型或无头浏览器。我一直在测试究竟是什么导致它们被标记,结果发现是指纹信息不一致。一个普通的无头Chrome在检测测试中得了100分,完全是机器人,但当使用与机器匹配的配置文件时,分数降到了15,与正常浏览器相同。错误的配置文件更糟糕,在我的Mac上使用Windows配置文件得了57分,比什么都不注入还差,因为一个信号与其他信号不一致。而且这些都不涉及网络方面,你的TLS和IP保持真实,因此你将配置文件与运行机器匹配,而不是伪造一切。为此,我维护了一个名为pydoll的Python库,它通过CDP直接驱动Chrome,无需webdriver,异步运行,因此代理可以运行多个标签页并拦截请求,而不会出现常见的自动化痕迹。指纹注入正是防止浏览代理被阻止的关键部分。
相似文章
“浏览器代理成本高昂且仍在成熟”这种表述可能忽略了架构方面的问题
讨论了当前使用无头Chrome加AI层的浏览器代理的架构问题,并介绍了Opera Neon的命令行界面作为替代方案,将AI集成到浏览器中,从而降低令牌开销并提高理解能力。
你需要理解的关键点:计算机使用代理与浏览器使用代理的区别
本文解释了计算机使用代理(通过像素截图操作完整桌面界面)与浏览器使用代理(可利用DOM隐藏结构)之间的关键区别,前者是更难的技术问题。
通过行为识别:利用UI痕迹对LLM浏览器代理进行指纹识别
本文证明,网站可以通过分析浏览代理的行为模式和时序数据,识别其背后的大语言模型,在14个前沿LLM上实现了高达96%的F1分数。本文正式定义了这一攻击面,并表明随机时序延迟不足以阻止识别。
BrowserAct
BrowserAct是一款为AI代理设计的网页浏览器自动化工具,可实现自动化的网页交互。
AI代理安全是模型说‘不’的小小祈祷。你们是如何路由模型的?
作者在Gmail上进行了实验,通过OAuth连接AI代理,发送了经过混淆的提示注入邮件。前沿模型有时能捕捉到攻击,而廉价模型则默默执行,揭示了代理安全很大程度上取决于模型成本和令牌预算,而非架构安全措施。