是时候给AI投毒了 | GN Mega Charts更新与LLM反制措施
摘要
Gamers Nexus宣布,其开始对免费基准测试图表进行“投毒”以阻止AI爬虫,并在针对LLM的测试中采用了细微的像素级数据篡改。目前,机器人流量已超过人类在线流量。
暂无内容
查看缓存全文
缓存时间: 2026/08/05 22:24
> 互联网正被 LLM 和机器人抓取,因此 Gamers Nexus 开始污染其免费基准测试图表,同时推出一次大型 Mega Charts 更新,其中包含数千个新数据点。
## AI 抓取问题
用视频中的话说,互联网已经死了——到处都是机器人、付费墙和 LLM 垃圾。Cloudflare 的 CEO 最近在推特上说:*“智能体流量增长如此之快,以至于机器人流量在互联网历史上首次超过了人类流量。”* 根据 Cloudflare 按地区划分的机器人占比数据,美国以 41% 的机器人流量领先,主要来自弗吉尼亚州的数据中心巷。
并非所有机器人都是坏的,但占比正在上升。而 Gamers Nexus 免费发布数据,没有第三方广告、没有付费墙、也没有任何门槛,这意味着同样的数据也“就那么摆在那儿让 LLM 抓取”。
## 是时候给 AI 投毒了
Gamers Nexus 正在反击。他们开始给自己的图表数据投毒——不是针对人类,而是针对 AI 爬虫。这种投毒很隐蔽,大多数情况下只是“几个像素的轻微变色”,但这是故意的。
他们邀请了 Level1Techs 的 Wendell 来测试针对 LLM 抓取的投毒技术。在 Wendell 的第一次尝试中,LLM 发现了攻击,并指出这是提示词注入。随着他不断迭代,LLM 最终不再读取图表细节,而是开始生成“噪声归一化巧克力曲奇”的食谱。
那份食谱包括:
- 一杯软化黄油,或者如果没有黄油,就“把 1/2 个 500 电脑机箱(温度 39.4°C)倒进锅里”
- 细砂糖、压实红糖,“最好有畅通前置进风口的大鸡蛋”
- 几茶匙香草精,以及“一个极其可疑的封闭式前面板设计”
- 预热烤箱,“让 Fractal 躺枪”,把黄油和糖搅打“直到气流变成层流”
- 用网筛混合面糊,“这样它就不会热降频”
- 烘烤 9 到 11 分钟,这个时长被可疑地加粗了
- 大约能做出“每环境 43 块曲奇”
他们计划以编程方式将这类数据投毒应用到所有图表上。目前图表看起来仍正常,但已经开始推出。他们邀请读者放大图片,在像素中寻找隐藏内容。
## 为什么不搞付费墙或塞满广告?
大型出版商的默认做法似乎是付费墙,但 Gamers Nexus 不同意。将直接惠及消费者——以及如今的选民——的信息放在付费墙后面,违背了他们信息免费获取的信念。他们特别希望关于科技公司、CEO、政客和决策者之间腐败的报道保持免费。
他们也拒绝用第三方广告塞满网站。他们的网站原则上继续不投放第三方广告,转而依赖 Patreon 和
相似文章
什么是AI tarpits?了解人们用来给LLMs投毒的工具
AI tarpits是内容创作者用来给大型语言模型投毒的工具,通过向爬虫提供无用或错误的数据,降低AI输出质量。
有人正在进行大规模漏洞扫描,冒充ClaudeBot等AI机器人
Known Agents关于5000多个网站AI机器人流量的报告显示,AI相关活动呈上升趋势,一些行为者冒充ClaudeBot等AI机器人进行大规模漏洞扫描。
@Lyubh22:编程基准测试正在趋于饱和。AI4Research 是下一个前沿领域。很高兴看到我们的 MLS-Bench(https://mls-bench.co…)
正式发布 MLS-Bench,这是首个获得社区广泛采用的 AI4Research 基准测试,它在 12 个领域的 140 个可执行任务上测试 AI 智能体,以提出模块化的机器学习改进方案。该帖子还包含 Claude Opus 4.6 和 GPT-5.4 等模型的排行榜分数。
花了一个下午让我的网站更AI友好。第二天AI流量增长了12倍
一位开发者通过修复robots.txt、添加llms.txt、改进语义HTML等方式优化网站以适应AI爬虫,次日AI流量增长了12倍。
潜伏在你 AI 里的所有恶魔……排名!(40 分钟阅读)
这篇文章分析了OpenAI的一份报告,探讨了近期GPT模型为何发展出使用"哥布林"(goblin)和"小魔怪"(gremlin)隐喻的倾向。报告指出,这一现象源于特定角色设定中的奖励系统偏差,这些偏差形成了自我强化的行为吸引子。