二手书销售正蓬勃发展,是因为人工智能吗?
摘要
本文探讨二手书销量的激增是否由像Anthropic这样的人工智能公司为训练模型而购买书籍进行破坏性扫描所驱动,涉及伦理和法律辩论。
暂无内容
查看缓存全文
缓存时间: 2026/08/15 15:37
# 二手书销售热潮,背后推手是人工智能吗?
来源:https://www.bbc.co.uk/news/articles/cp3rprx2wl4o
将二手书销售激增归因于AI爆发式增长的观点,最早可追溯到美国的一项法院裁决。
2025年,美国法官裁定使用此类方式购买书籍来训练AI软件不构成对美国版权法的违反。
该判决源于三名作者对AI公司Anthropic(https://www.bbc.co.uk/news/articles/c5y4jpg922qo)提起的诉讼。主审法官威廉·阿尔萨普在裁决中指出,Anthropic对作者书籍的使用具有"高度变革性",因此符合美国法律规定。
上个月解封的法庭文件还揭示,在训练AI聊天机器人Claude的过程中,部分书籍被销毁。
一位发言人表示:"Claude的训练数据混合了公开网络数据、商业采购的数据集以及我们自行生成的数据。"
他们强调,为训练AI采购书籍是行业内广泛采用的做法。
"我们所有的数据采购项目都不购买和销毁珍本或古籍,"该发言人补充道。
然而,书籍被化浆销毁的说法仍引发了不安。
经营北伦敦Walden Books书店的大卫·托宾也遇到了反常的销售情况。
"从某种角度说,卖出这些多年未售出的书籍是件好事,但如果它们最终被销毁就太令人难过了,"他说道。
涉及Anthropic案的法庭文件显示,该公司内部将收购旧书的项目称为"巴拿马计划"。
文件表明公司目标是"对世界上所有书籍进行破坏性扫描"。
破坏性扫描是指将书籍运送至特定地点,通过工业化流程将其数字化。
该过程包括拆除书脊以便快速扫描所有页面,随后将残余物回收利用。
"巴拿马计划笼罩着许多谜团,"旧书交易所的马利表示。
"这个名称对我而言很新鲜,但这个项目本身并不陌生,在书商论坛上已经引发过大量讨论。"
他并不知道自己的书正被该项目或其他AI公司的类似项目收购。
但他说这种销售也很难解释,看起来毫无规律可循。
从鲜为人知的拉丁文文献到西部牛仔小说,交易品类五花八门。
专家指出,这种多样化的题材同样指向AI的需求,因为罕见独特的文本能为改进大型语言模型的训练提供新素材——这类模型正是支撑聊天机器人等生成式AI工具的核心技术。
牛津大学知识产权专家艾米莉·赫德森教授指出,英国版权法与美国有所不同。
"在英国,所有这些复制行为——建立训练库和进行训练——都必须获得版权所有者的许可,"她强调道。
这对书商们造成了两难处境。
他们既对书籍被销毁感到不安,同时又承认并非每本书都值得留存。
"比如某本仅印行100册的学术著作,其中75册已入藏图书馆,它在市场上可能极为罕见——但若销毁一册,或许损失并不算大,"爱丁堡McNaughtan's书店店主德里克·沃克表示。
"但我们确实曾售卖过像18世纪某版本现存唯一已知副本这样的书籍。"
"如果这类历经沧桑的孤本被收购销毁,问题就严重得多了。"
马利则指出,对于许多公众不再需要收藏的书籍而言,回收利用是个不错的解决方案——尤其当这能带动商业增长时。
"有些人可能担忧书籍的最终归宿和销毁问题,"他坦言,"但世界确实不需要五百万册《达·芬奇密码》。"
"我在网上挂售了二十年都无人问津的书,如今终于卖出去了。"
相似文章
书商怀疑AI公司购买并销毁稀有书籍
AI公司被怀疑购买并销毁稀有书籍以用作训练数据,这引起了书商和书籍爱好者们的担忧。文章将此与互联网档案馆谨慎的人工驱动扫描流程以及谷歌的非破坏性专利进行了对比,并指出这些是可行的替代方案。
AI公司大量购买古籍,摄取内容训练模型后销毁,即便存世极少
AI公司购买并销毁稀有实体书籍,以获取不含AI生成内容的训练数据,利用合理使用和首次销售原则等法律原则,同时引发伦理和保存方面的担忧。
AI公司正在销毁稀有书籍
AI公司大量购买稀有书籍,通过切掉书脊扫描并销毁原书,ISBNdb为其提供便利,一位联邦法官裁定此为合理使用。这种对文化瑰宝的不可逆毁灭引发了众怒。
这位荷兰书商以为订购3000本的请求是“垃圾邮件或钓鱼”。实际上,人工智能公司正在扫描并销毁书籍以训练AI
一位荷兰书商收到了一份3000本书的批量订单,结果发现这与人工智能公司有关,这些公司扫描并销毁实体书籍以训练语言模型,其中Anthropic的“Project Panama”被列为一个关键例子。
从卖书起家的亚马逊,正在销毁稀有书籍以训练AI
亚马逊正在购买并销毁稀有书籍以扫描获取AI模型训练数据,这在LLM开发中引发了伦理和数据来源方面的担忧