@FinanceYF5: Meta 非法从 LibGen、Anna's Archive 和 Z-Library 下载了超过 80 TB 的书籍,用于训练其 AI 模型。 Aaron Swartz 在 2010 年从 JSTOR 下载了 70 GB 的论文(仅相当于…

X AI KOLs Following 新闻

摘要

Meta被指控非法从LibGen、Anna's Archive和Z-Library下载超过80TB的书籍用于训练AI模型。文章对比了Aaron Swartz因下载少量论文而面临严厉指控的案例,突显了版权执法中的双重标准问题。

Meta 非法从 LibGen、Anna's Archive 和 Z-Library 下载了超过 80 TB 的书籍,用于训练其 AI 模型。 Aaron Swartz 在 2010 年从 JSTOR 下载了 70 GB 的论文(仅相当于 Meta 的 0.0875%),却面临 100 万美元罚款和 35 年监禁的指控,并于 2013 年自杀身亡。 https://t.co/OOyX8LmzeS
查看原文
查看缓存全文

缓存时间: 2026/05/08 10:46

Meta 非法从 LibGen、Anna’s Archive 和 Z-Library 下载了超过 80 TB 的书籍,用于训练其 AI 模型。

Aaron Swartz 在 2010 年从 JSTOR 下载了 70 GB 的论文(仅相当于 Meta 的 0.0875%),却面临 100 万美元罚款和 35 年监禁的指控,并于 2013 年自杀身亡。 https://t.co/OOyX8LmzeS

相似文章

@Phoenixyin13: 这篇来自Meta FAIR的最新重磅论文,旨在告诉AI行业一句重要的风向标: “大模型数据,正在迎来智能科学家时代。” 在这篇论文里, 一个经过 Autodata 精准洗礼的 4B小模型,在法律推理任务上,不仅碾压了传统合成数据训练出来的…

X AI KOLs Timeline

Meta FAIR最新论文提出Autodata方法,通过智能数据科学家Agent自主生成和优化高质量数据,使4B小模型在法律推理任务上击败397B大模型,预示数据质量可弥补参数量鸿沟,为数据pipeline和scaling提供新思路。