关于 Wayback Machine 访问的更新
摘要
为处理高流量的自动化访问,Internet Archive 在 Wayback Machine 上实施了保护措施,但有时会误阻合法用户。他们正改进机器人检测机制,并建议用户若被错误阻止可联系支持。
暂无内容
查看缓存全文
缓存时间: 2026/09/15 20:56
# 关于 Wayback Machine 访问的更新
来源:https://blog.archive.org/2026/09/15/an-update-on-wayback-machine-access/
[](https://blog.archive.org/wp-content/uploads/2024/02/wayback_logo-scaled.jpg)我们听到了大家的呼声:“修复 Wayback Machine!”
以下是目前的情况。互联网档案馆的 Wayback Machine(https://web.archive.org/)遭到了大量自动化流量的冲击,我们已采取保护措施以维持服务运行。近期的一项改动是:我们重写了当请求因 429 错误(HTTP 状态码,意为“请求过多”)被拦截时显示的消息。
这些保护措施有时会误伤真实用户。如果您因此受到影响,我们深表歉意,同时感谢您在我们努力减少错误期间的耐心配合。
我们正在不断提升区分滥用机器人和每日依赖 Wayback Machine 的正常用户的能力。如果您认为自己被误拦,请通过 [info@archive\.org](mailto:[email protected]) 发送邮件,并附上您的操作系统、浏览器和 IP 地址,我们将进行调查。
相似文章
呼吁《纽约时报》、《大西洋月刊》和《今日美国》停止屏蔽网页存档
一份请愿书呼吁《纽约时报》、《大西洋月刊》和《今日美国》等主流媒体恢复与互联网档案馆的合作,理由是屏蔽 Wayback Machine 有损新闻自由并破坏历史记录的保存。
逝去却未被遗忘:恢复已死的网页
一篇来自互联网档案馆的博客文章,分析了近期关于链接失效的研究(皮尤、Zittrain、ODU),并展示了 Wayback Machine 如何挽救了大约15%原本已死的网页,凸显了网络衰落的持续问题以及网络存档的作用。
超过340家地方新闻媒体正在限制Internet Archive的访问权限
超过340家地方新闻媒体已采取措施限制Internet Archive访问其内容,可能是出于版权或抓取方面的考虑。
爬虫情况更新
关于AI爬虫机器人日益严重的问题的最新更新,这些机器人导致网站不堪重负,并探讨了住宅代理网络及其对开放网络的影响。
在机器人时代保持网络的开放与隐私
Mozilla和Cloudflare正与其他浏览器合作,推出一项新举措,旨在打击机器人滥用行为的同时保护用户隐私。该方案提出采用基于匿名担保的速率限制方法,而非像验证码或Web环境完整性这样侵入性的验证方式。