对《Obscure Sorrows》的全盘抄袭

Hacker News Top 新闻

摘要

本文揭露了约翰·柯尼希(John Koenig)的《The Dictionary of Obscure Sorrows》的一个抄袭版本,该版本抄袭了整本书的文字,并用AI生成的图片替换了原始插图,同时还使用GPT-4让用户创作新的“悲伤”词条。这一事件引发了对AI助长抄袭和侵犯版权的担忧。

暂无内容
查看原文
查看缓存全文

缓存时间: 2026/06/20 20:17

# 《隐秘的悲伤》的大规模抄袭 - Waxy.org 来源:https://waxy.org/2026/06/the-wholesale-plagiarism-of-obscure-sorrows/ 上周,一位 MetaFilter 用户发布了一个链接(https://www.metafilter.com/213450/The-tears-of-things),指向一个看似是 The Dictionary of Obscure Sorrows(https://www.thedictionaryofobscuresorrows.com/)的新网站,这是 John Koenig 耗时十年的项目(https://dictionaryofobscuresorrows.com/),旨在打造一本“为那些我们都能感受到却无法言说的情绪创造新词的词典”。 [](https://www.thedictionaryofobscuresorrows.com/)这个精心设计的网站包含了你对出版商宣传书籍网站的所有期待:作者简介(https://www.thedictionaryofobscuresorrows.com/author)、媒体报道(https://www.thedictionaryofobscuresorrows.com/press),以及亚马逊购书链接(https://www.thedictionaryofobscuresorrows.com/buy-the-book)。 奇怪的是,它还包含了*整本书的完整文本*,从开篇 800 字的前言(https://www.thedictionaryofobscuresorrows.com/about)到所有 311 个新词(https://www.thedictionaryofobscuresorrows.com/words)的完整存档,每个词都配有定义、词源和短评,均由 Koenig 撰写。 书中由 Koenig 和其他几位艺术家创作的原版照片拼贴插图明显缺失。取而代之的是每个词配有一张由 DALL-E 2 生成的 AI 图像,充满了该模型常见的错误和伪影。 “现在已经是 IŊΨ 点半了”主页顶部的一条横幅鼓励访客“使用 AI 生成你自己的词——给你的悲伤一个声音!”提交悲伤(https://www.thedictionaryofobscuresorrows.com/submit-a-sorrow)功能让你描述一种感觉,然后使用 OpenAI 的 GPT-4 生成新词、词源和定义,这些内容会进入一个带有 AI 生成艺术的“用户生成悲伤(https://www.thedictionaryofobscuresorrows.com/sorrows)”画廊。 MetaFilter 成员立刻起了疑心,我也一样。我和妻子 Ami 在 2022 年制作了一款卡片游戏 Lost for Words(https://lostforwords.cards/),部分灵感来源于 Koenig 的项目。我们有一本实体书,而且我在网上关注这个项目多年。拥抱 AI 似乎不符合他一贯的风格。 然后我注意到新网站与原来的 Tumblr 主页(https://dictionaryofobscuresorrows.com/)完全是不同的域名: 原版:dictionaryofobscuresorrows.com 新版:**the**dictionaryofobscuresorrows.com 这到底是怎么回事? ## 一点历史 John Koenig 于 2009 年在 Tumblr 上启动了 The Dictionary of Obscure Sorrows,并在 2013 年扩展为一系列广受欢迎的视频散文(https://www.youtube.com/@obscuresorrows/videos)。 如果你知道这个项目里的任何一个词,那很可能就是“sonder(https://dictionaryofobscuresorrows.com/post/23536922667/sonder)”,它远远超出了原始出处,进入了日常用语,最终被 Dictionary.com(https://www.dictionary.com/browse/sonder)和 Merriam-Webster(https://www.merriam-webster.com/dictionary/sonder)收录。 > ***sonder*** *n. 意识到每个随机路人都过着和你一样生动复杂的生活——充满他们自己的抱负、朋友、日常、担忧和继承来的疯狂——一部史诗般的故事在你周围无形地继续,就像一座向地下深处蔓延的蚁丘,拥有通往成千上万其他生活的精巧通道,而你永远不会知道它们的存在,在其中你可能只出现一次,就像一个在背景中啜饮咖啡的临时演员,像高速公路上掠过的一抹车流,像黄昏时一扇亮灯的窗户。* Koenig 创造的其他词也在他的项目之外找到了生命。你可能遇到过“anemoia”(对从未经历过的时代或地方产生怀旧之情)、“vellichor”(旧书店那种奇特的眷恋),或者“monachopsis”(那种微妙但持续的格格不入感)。 但“sonder”是最成功的突破。我敢打赌,大多数听说过这个词的人根本不知道它是由一个家伙在 2012 年(https://dictionaryofobscuresorrows.com/post/23536922667/sonder)的 Tumblr 上创造的。 有一个 R&B 乐队(https://www.instagram.com/sonder/)叫 Sonder,一个失败的 Airbnb 竞争对手(https://www.cnn.com/2025/11/11/business/sonder-bankruptcy-marriott-deal-ends),以及无数企业,从咨询公司(https://www.sonderdesign.org/)和风投公司(https://sondercapital.com/)到咖啡馆(https://www.sondercoffeelounge.com/)和药房(https://sondertime.com/)。离我现在两英里的地方就有一家叫 Sonder 的酒吧(https://www.thesonderbar.com/)。 来自官方 Instagram(https://www.instagram.com/p/CWVyF10lZyG/)宣布书籍发行的照片 这一成功为 Koenig 赢得了与 Simon & Schuster 的出版合同,这本书(https://www.simonandschuster.com/books/The-Dictionary-of-Obscure-Sorrows/John-Koenig/9781501153648)于 2021 年 11 月发行后成为《纽约时报》畅销书。 两年后,大约在 2023 年 8 月,新的 Dictionary of Obscure Sorrows 网站上线,但奇怪的是,官方 Tumblr 页面或社交媒体上完全没有提及。 ## 一个精明的冒牌货 用 Koenig 自己的话说,他的项目使命是“照亮作为人类的基本奇异之处”。 因此,他现在竟鼓励人们用 LLM 生成新词和定义,这感觉很奇怪。LLM 是一种有争议的技术,它基于大量人类写作进行训练,却无法理解身为人类是什么感觉。 我直接联系了 John Koenig,问他是否参与了那个网站。他一小时后回复了邮件: > 是啊,老兄,我跟它毫无关系。不知道该怎么想或怎么做,因为那个网站挺精明的。比我自己那个还好,真的。 找到谁干的并不难,因为他们在每个页面的页脚“网站制作方”里列出了自己:Qontour(https://www.qontour.com/)(前身为 Prompt Digital),一家总部位于旧金山的网页设计与营销机构。 唯一暗示该网站未经授权的线索是他们的作品集页面(https://www.qontour.com/portfolio/the-dictionary-of-obscure-sorrows),其中谈到“Qontour 构建了交互式数字平台——在 Webflow 中设计网站,生成 AI 驱动的图像库,并推出了一项功能,让访客提交自己的悲伤并为词典添加新定义”。 在该页面上,他们自称是这本书的“粉丝”:“该网站为**粉丝(比如我们)**提供了一个找到所有内容的地方——视频、评论、采访和购买链接——而无需在十几个平台上搜索。” 当然,问题在于,身为粉丝并不意味着他们有权将任何材料用于自己的网站。 ## 版权与混淆 在 Qontour 未经授权的网站页脚中,他们添加了一条版权声明,承认自己不拥有网站上任何材料的权利,同时将所有用户提交的词以 CC Zero 许可证开放到公共领域。 > 词典内容 © John Koenig – 保留所有权利。用户生成内容开放许可 – CC Zero。 这暴露了对版权运作方式的基本误解。Qontour 无权为了展示自己的网页设计技能而出版 Koenig 的整本书。 他们还将自己的网站提交到了 Webflow 的目录(https://webflow.com/made-in-webflow/website/dictionary-of-obscure-sorrows)来宣传他们的设计业务。“这项工作展示了我们在网站设计、AI 生成内容和广泛内容集成方面的专业知识。” 在“雇佣 Qontour”按钮下方,一个指向“版权信息”的小链接歪曲了他们的工作: > Dictionary of Obscure Sorrows by Qontour 采用 Creative Commons Attribution-NonCommercial-NoDerivatives 4.0 International License 许可。保留所有权利。换句话说,这是别人的作品,所以你不得以任何理由复制或编辑它,但你可以与他人分享。 不用说,你不能重新许可你不拥有的内容。 更复杂的是,Qontour 声称这是一份粉丝致敬作品,但他们还在整个网站上使用了他们自己的亚马逊联盟代码,该代码是以他们之前的名称 Prompt Digital 创建的,这让他们从所有图书销售(https://www.thedictionaryofobscuresorrows.com/buy-the-book)中分得一杯羹。 这些佣金在过去几年可能相当可观,因为这个非官方网站现在几乎是所有与这本书相关查询的搜索结果第一名,包括书名(https://www.google.com/search?q=dictionary+of+obscure+sorrows)、书中创造(https://www.google.com/search?q=anemoia)的词(https://www.google.com/search?q=sonder+word)、书中(https://www.google.com/search?q=enouement)的词(https://www.google.com/search?q=monachopsis)、书中(https://www.google.com/search?q=lachesism)的词,甚至 John Koenig 的名字(https://www.google.com/search?q=john+koenig)。在我尝试过的每一次谷歌搜索中,非官方网站的排名都高于官方网站、出版商网站或维基百科。 这种情况随着从传统网络搜索向对话式 AI 搜索的迅速转变而变得更糟,后者容易被操纵,隐藏来源,并将上下文压缩成简单的答案。 ChatGPT 和 Gemini 都将盗版网站链接为官方网站,并且都声称 John Koenig 是它的创建者。 Gemini(左)和 ChatGPT(右) 这造成了对其作者的合法混淆,并且可以说,由于其对 AI 的热衷追捧,损害了项目和书籍的声誉。最初将网站发布到 MetaFilter 的人以为那是官方网站,而帖子中的评论者(https://www.metafilter.com/213450/The-tears-of-things)随后合理地质疑这本书本身是否由 AI 撰写。 我问 Koenig 他的出版商是否计划对这个网站发出停止侵权函(cease-and-desist),但没有收到回复。 在给他发邮件后,我意识到 Simon & Schuster *确实*在去年采取了一些行动来限制其影响力。他们去年 7 月向谷歌提交了两份 DMCA 删除通知(1(https://lumendatabase.org/notices/54246288),2(https://lumendatabase.org/notices/54256374)),要求从搜索结果中删除盗版网站的两个页面。但没有任何效果。 ## 人工智能与同意 粉丝出于对原始材料的热爱、没有商业动机而分享或混音受版权保护的内容是一回事(“无意侵权(https://waxy.org/2011/12/no_copyright_intended/)!”)。一家营销机构拿走一位在世作者的全部书籍,用 AI 垃圾替换其艺术,添加一个 AI 单词生成器,将流量变现,在自己的作品集中宣传,然后在所有地方超越官方网站,这完全是另一回事。 这是一种比通常所见更明目张胆的抄袭形式——通常的做法是,人类创作的作品被 AI 模型“洗”成与来源足够不同的东西,以避免法律问题。 但看到它来自一家如此深度投入生成式 AI 的机构,并不令人惊讶。正如他们自豪地解释(https://www.qontour.com/tools/claude)的那样,“此网站上的每个页面都是用 Claude 编写的”,使用他们称之为“Q”的“作者角色”。 这里缺失的是**同意**,这感觉像是 AI 的原罪。正如我之前多次(https://waxy.org/2022/08/opening-the-pandoras-box-of-ai-art/)写过(https://waxy.org/2022/09/ai-data-laundering-how-academic-and-nonprofit-researchers-shield-tech-companies-from-accountability/)的(https://waxy.org/2022/11/invasive-diffusion-how-one-unwilling-illustrator-found-herself-turned-into-an-ai-model/),生成式 AI 模型都在大量人类创作的作品语料库上进行训练,没有署名、没有同意、没有补偿,从创作者身上提取价值,同时将权力集中在极少数大型科技公司手中。 在更小的规模上,Qontour 本可以联系 John Koenig,请求许可重新发布他的作品,并与他合作,为这本书创建一个新的、改进的网站。他可能会要求他们仅限于发布他在 Tumblr 上发表的词,要求他们不要构建 AI 功能,或者可能直接对整个事情说“不”,而这本是他的权利。 ## 最后一言 发生在 Dictionary of Obscure Sorrows 上的事可能更加肆无忌惮,但这并非孤例。 这是整个网络正在发生的一个广泛趋势的一部分:人们使用 AI 来重新包装、优化和替换它所训练过的权威来源,以谋取利益。 几乎每天,我都会收到一封邮件,里面是一个刚刚启动、明显是“vibe-coded”(氛围编码)的网站,充满了 AI 生成的内容,旨在从人类创作者(博客作者、作家、记者、艺术家、音乐家以及任何其他缓慢而辛苦地以此为生的人)那里吸走注意力。我甚至不再确定我收到的邮件是不是人类发送的。 看到你喜欢的东西被一台旨在取代创造它的人的机器吞并和再利用,这种感觉似乎是一种独特的现代悲伤。 也许应该有一个词来形容它。 --- 你可以从 Powell's Books(https://www.powells.com/book/the-dictionary-of-obscure-sorrows-9781501153648)、直接从他的出版商(https://www.simonandschuster.com/books/The-Dictionary-of-Obscure-Sorrows/John-Koenig/9781501153648)或你当地的独立书店(https://www.indiebound.org/)购买 John Koenig 的《The Dictionary of Obscure Sorrows》。如果你必须使用亚马逊,你可以使用作者自己的联盟代码(https://www.amazon.com/exec/obidos/ASIN/1501153641?tag=simonsayscom)购买,这样他就能获得最大份额的销售佣金。 照片来源:John Koenig(https://dictionaryofobscuresorrows.com/post/668027938834382848/this-project-started-here-on-tumblr-more-than-10)

相似文章

AI只是更大规模的无授权抄袭

Hacker News Top

作者认为,AI模型通过未经同意训练受版权保护的内容构成无授权抄袭,并且AI生成的仿冒品在搜索结果中排名超过了原创者。

AI公司正在销毁稀有书籍

Hacker News Top

AI公司大量购买稀有书籍,通过切掉书脊扫描并销毁原书,ISBNdb为其提供便利,一位联邦法官裁定此为合理使用。这种对文化瑰宝的不可逆毁灭引发了众怒。

他用50篇文章操控AI搜索(曝光GEO/AEO)

YouTube AI Channels

SEO操盘手Kasra Dash演示,仅靠50篇自引式清单文章,就在无需外链的情况下劫持了ChatGPT、Claude、Gemini、Perplexity、Grok及Google AI概览的排名,且即使删除后URL仍被持续引用。

AI儿童图书:身体恐怖版

Hacker News Top

分析亚马逊上的AI生成儿童书籍,指出普遍存在的质量问题和怪异的视觉错误(即“身体恐怖”),这些问题削弱了先进AI模型的前景。

书商怀疑AI公司购买并销毁稀有书籍

Ars Technica

AI公司被怀疑购买并销毁稀有书籍以用作训练数据,这引起了书商和书籍爱好者们的担忧。文章将此与互联网档案馆谨慎的人工驱动扫描流程以及谷歌的非破坏性专利进行了对比,并指出这些是可行的替代方案。