进攻性互联网姿态
摘要
作者解释了如何通过伪造 WordPress 登录、endlessh tarpit、阻止 AI 爬虫、伪造 phpinfo、无限虚假网站以及提示注入来毒化大语言模型,从而保护他的 VPS 和博客免受机器人和爬虫的侵扰。
<p><a href="https://lobste.rs/s/fgcrj0/offensive_internet_posture">评论</a></p>
查看缓存全文
缓存时间: 2026/08/05 13:58
# 进攻性互联网姿态 - 信息伪装
来源:https://bruceediger.com/posts/offensive-machine/
我做了这些事情,让运行此博客的VPS对互联网寄生虫们不那么有吸引力。
1. 假的WordPress登录页面(https://bruceediger.com/blog/wp-login.php),永远不会接受凭证,但确实需要5秒才拒绝它们。
2. 在22端口运行endlessh(https://github.com/skeeto/endlessh),真正的`sshd`监听在*另一个端口*。
3. 某些用户代理(如Meta的)总是收到403 HTTP状态码。
4. 某些用户代理(包括xAI、Claude、GPTbot)被引导到一个无限虚假网站(https://bruceediger.com/posts/anti-seo-infinite-website/)。
5. 如果有人请求/phpinfo.php(https://bruceediger.com/phpinfo.php)URL,返回假的phpinfo(https://www.php.net/manual/en/function.phpinfo.php)输出。
6. `robots.txt`对许多爬虫设置了长时间延迟,并“禁止”访问一个不存在的`/porn`目录。
7. 运行一个爬虫垃圾场(https://bruceediger.com/posts/drunkmenworkhere-on-bots/),拥有超过200万个虚假网页。
8. 尝试通过我所有博客页面的页脚进行提示注入,或至少污染一些LLM。见下文。
9. 运行一个TFTP蜜罐(https://bruceediger.com/posts/tftp-honeypot/),给那些可怜的被蒙蔽者一点小刺激——他们总是在扫描互联网寻找配置错误的TFTP服务器。
10. 这个网站的联系页面(https://bruceediger.com/contact/)除了浪费垃圾邮件发送者的时间和精力外什么也不做。它还会设置0到25个随机命名的cookie,所以也许别去访问它。
我还能做的其他事情:
1. 运行SMTP、Telnet和FTP蜜罐。这些遗留协议很难完美模拟。
2. 将Google的用户代理引导到无限虚假网站。如果Google不给我带来流量,我为什么要给它喂LLM的素材?
3. 让我的WordPress蜜罐(https://bruceediger.com/phparasites/)上线。
我的论点是,如果互联网上有一定比例的机器运行蜜罐,或普遍对寄生虫的努力采取进攻性行为,那么寄生虫们就会收拾东西离开。我不知道这个比例是多少,但我推测它超过10%。
我们中那些能够对SSH扫描器进行tarpit,或运行SMTP蜜罐的人应该这样做。我还认为,有能力做这些事情的人最好以独特的方式去做。对于市值数十亿美元的公司来说,要处理数百种不同类型的Web服务器爬虫垃圾场要困难得多。而对于一个人的寄生虫运营来说,这样做是不可能的。
相似文章
黑客可利用9种最流行AI工具组建大规模僵尸网络
研究人员设计了一种名为HalluSquatting的基于拉取的提示注入攻击,利用AI编程助手易出现资源标识符幻觉的特点,从而能够组建大规模僵尸网络并发起大规模攻击。
一次失败的(国家支持?)攻击剖析
对一次针对Rust开发者的复杂假面试骗局的详细复盘,该骗局涉及伪造的VC人设和通过TypeScript仓库投递的定制RAT。作者凭借警惕性和AI辅助代码审查成功规避了感染。
捕获了一个 .git/config 爬虫
作者描述了他们的蜜罐网站如何通过提供虚假的 git 仓库数据捕获了一个 .git/config 爬虫,并分析了显示单个 IP 地址大量爬取活动的 Apache 日志。
@hetmehtaa: 本地AI用于渗透测试与研究 https://projectblack.io/blog/local-ai-for-cyber-security/…
一篇博客文章对四种方法(Semgrep、搭载Strix的GLM 5.1、具备代码审查技能的云端SOTA、以及使用自定义工具的本地AI)在PHPIPAM中发现已知LFI漏洞的表现进行了基准测试,结果显示采用定制化方案的本地AI工具优于其他方法。
一种让你的DHCP服务器耗尽动态IP的不寻常方式
克里斯·西本曼解释了他的反爬虫措施,由于针对LLM训练的高频爬虫激增,他阻止旧版浏览器,这给Feed阅读器和存档服务带来了混乱。