@FinanceYF5: Meta 非法从 LibGen、Anna's Archive 和 Z-Library 下载了超过 80 TB 的书籍,用于训练其 AI 模型。 Aaron Swartz 在 2010 年从 JSTOR 下载了 70 GB 的论文(仅相当于…
摘要
Meta被指控非法从LibGen、Anna's Archive和Z-Library下载超过80TB的书籍用于训练AI模型。文章对比了Aaron Swartz因下载少量论文而面临严厉指控的案例,突显了版权执法中的双重标准问题。
查看缓存全文
缓存时间: 2026/05/08 10:46
Meta 非法从 LibGen、Anna’s Archive 和 Z-Library 下载了超过 80 TB 的书籍,用于训练其 AI 模型。
Aaron Swartz 在 2010 年从 JSTOR 下载了 70 GB 的论文(仅相当于 Meta 的 0.0875%),却面临 100 万美元罚款和 35 年监禁的指控,并于 2013 年自杀身亡。 https://t.co/OOyX8LmzeS
相似文章
@Crypto_hedyEth: 大多数人浪费大量时间寻找优质AI资源。 这个GitHub仓库悄悄放出13本免费AI书籍。全是干货,无废话。 https://github.com/AniruddhaChattopadhyay/Books… 这里面有啥 LLM基础 → 分词…
这个GitHub仓库提供了13本免费的AI/ML书籍,涵盖LLM、强化学习、深度学习面试等多个方面。
Anna's Archive 遭1950万美元缺席判决及全球域名下架令
在主要出版商因版权侵权及该网站被用作人工智能公司训练数据枢纽而提起诉讼后,纽约联邦法官批准了对影子图书馆 Anna's Archive 的1950万美元缺席判决,并下令全球域名下架。
出版商和 Scott Turow 在诉讼中指控 Mark Zuckerberg“亲自授权并积极鼓励”Meta 大规模侵犯版权以训练 AI 系统
图书出版商及作者 Scott Turow 对 Meta 及其 CEO Mark Zuckerberg 提起集体诉讼,指控该公司非法复制数百万部版权作品用于训练其 Llama AI 模型,从而规避了许可和版权保护。
AI公司大量购买古籍,摄取内容训练模型后销毁,即便存世极少
AI公司购买并销毁稀有实体书籍,以获取不含AI生成内容的训练数据,利用合理使用和首次销售原则等法律原则,同时引发伦理和保存方面的担忧。
@Phoenixyin13: 这篇来自Meta FAIR的最新重磅论文,旨在告诉AI行业一句重要的风向标: “大模型数据,正在迎来智能科学家时代。” 在这篇论文里, 一个经过 Autodata 精准洗礼的 4B小模型,在法律推理任务上,不仅碾压了传统合成数据训练出来的…
Meta FAIR最新论文提出Autodata方法,通过智能数据科学家Agent自主生成和优化高质量数据,使4B小模型在法律推理任务上击败397B大模型,预示数据质量可弥补参数量鸿沟,为数据pipeline和scaling提供新思路。