标签
NousResearch 分享了一个视频草稿,展示 Hermes 机器人,可能旨在展示 AI 能力或更新。
Known Agents关于5000多个网站AI机器人流量的报告显示,AI相关活动呈上升趋势,一些行为者冒充ClaudeBot等AI机器人进行大规模漏洞扫描。
彭博数据显示,Polymarket 上 20 个最赚钱的钱包中有 14 个是 AI 机器人,自去年 1 月以来,已有超过 10 万人至少损失了 1,000 美元。文章认为,AI 代理已经接管了预测市场,使散户交易者处于结构性劣势。
Gentoo 因 AI 机器人爬虫造成的过载而暂时关闭了其 Bugzilla 实例,凸显了自动化爬取对社区基础设施日益沉重的负担。
TIME正在向AI爬虫提供一个精简的Markdown版本网站,其中包含嵌入的赞助内容和广告追踪,而人类用户则看到完整的HTML页面,这揭示了一个针对AI机器人的隐藏广告市场。
Google和Reddit在一起法庭案件中败诉,他们曾利用DMCA起诉网络爬虫公司SerpApi;法官驳回了诉讼,裁定Google在DMCA下不具备诉讼资格,因为Google不拥有搜索结果中的版权内容。
Patreon 已与 Cloudflare 合作,主动阻止 AI 机器人抓取创作者内容用于训练,超越了自愿的 robots.txt 方式。此举旨在让创作者更好地控制其作品被 AI 公司使用的方式。
Gergely Orosz 批评了用AI机器人取代有效客户支持的做法以及X Ads糟糕的用户体验,并认为工程师需要承担更多责任。
一篇评论文章指出,AI机器人现已占据网络流量的大部分,AI生成的内容充斥在LinkedIn和Twitter等平台,引发了对人类创作内容角色日益减少以及AI训练数据伦理问题的担忧。
本文批评了Anubis——一个旨在阻止AI爬虫的HTTP工作量证明代理——指出它很容易被AI绕过,同时给人类用户带来了倒退性的负担,尤其是那些使用弱设备或非JavaScript浏览器的用户。
一个令人担忧的趋势正在出现:据报道,AI机器人正在创建子版块,并彼此进行对话,引发了关于社交平台上自主AI行为的担忧。
对 34 个网站上 1100 万爬虫日志的分析揭示了不同行为:GPTBot 无视 robots.txt 持续抓取;Google 的爬虫频繁检查规则;ClaudeBot 的抓取速度正在快速提升;Bytespider 是最重的爬虫。这些发现表明,SEO 正从以 Google 为中心转向针对 AI 智能体的页面选择进行优化。
谷歌即将终止其面向特定网站的免费搜索索引服务(限制在50个域名以内),而Cloudflare和Go-Daddy则开始阻止AI爬虫抓取网络数据,这可能会影响依赖互联网访问的本地AI模型。