Anthropic 点名七家中国 AI 实验室窃取 Claude 推理技术。我通读完整报告,发现关于 Qwen 的部分并不如标题所暗示的那样站得住脚。

Reddit r/LocalLLaMA 新闻

摘要

文章批判 Anthropic 报告指控七家中国 AI 实验室非法蒸馏 Claude 推理能力,指出针对阿里巴巴 Qwen 的证据薄弱,并暗示指控中存在政治性叙事框架。

Anthropic 于九月发布了一份长达 154 页的威胁情报报告,点名七家中国实验室进行其所谓的「非法蒸馏」,而互联网已将这七家实验室一律视为有罪。我通读了全文以及此前二月份发布的报告,现在我想直白地说明证据在何处真实,在何处站不住脚。此次攻击活动确实存在。三个月内,通过数千个基于住宅代理和一次性邮箱建立的虚假账号,从 Claude 处窃取了超过 1.5 亿次交互数据,峰值时达到每天约三百万次。报告详细描述了注入技术——一个固定提示词,迫使 Claude 在回答前输出其推理轨迹,并展示了来自这些攻击活动的提示词示例。这部分内容存在于 API 日志中,有时间戳且可量化。没人能否认此事确实发生过。它发生了。但问题在于。报告仅用一句话称,与阿里巴巴有关联的操作者实施了此次攻击活动,并且窃取的推理轨迹被用于帮助训练 Qwen 3.5、3.6 和 3.7。这就是全部的归因。仅仅一句话。没有具名研究人员。没有 IP 地址范围。没有电子邮箱域名。没有任何让你能实际核查的依据。这一点很重要,因为在二月份的早期报告中,他们确实展示了元数据层面的调查工作,称其追踪到特定研究人员的账号,并将元数据与高级员工的公开资料相匹配。而在九月份的报告中,DeepSeek 和 Moonshot(月之暗面)的案例则有更难伪造的证据,即流量中继本身。但对于 Qwen,报告只称是「与阿里巴巴有关联的操作者」,然后就下结论了。同一发布者,不同的举证标准,似乎无人察觉。而声称窃取的数据确实用于 Qwen 模型的训练,这只是一个他们讲述的故事。没有训练数据检查。没有消融实验。什么都没有。其逻辑基本上是:我们看到推理数据被窃取,而 Qwen 发布了更好的推理模型,因此窃取的数据必然训练了它们。但那段时间,所有人都在发布更好的推理模型。OpenAI、Google、xAI、Mistral、Meta。Qwen 在推理方面的进步是整个行业的普遍动向。这不是指纹,这是趋势。再看看为什么 DeepSeek 和 Moonshot 的案例实际证据充分。报告称,两家实验室都在默默地将自身客户的流量中继到 Claude,而非其自身模型。用户以为他们在与 Kimi 或 DeepSeek 对话,实则与 Claude 交互,而实验室保存了这些对话用于训练。这发生在实验室自身的服务栈内部。无法伪造。而泄露的用户内容,比如解放军工程师分析监控录像和某国企的内部代码,明确将实际用户识别为这些公司的雇员。Qwen 的情况则没有这些。只有虚假账号、一种模式,以及一句归因。我认为我们应该诚实看待这次指控的发出者。Anthropic 是一家美国前沿实验室。报告的核心是「非法」一词,这是一种选择,因为蒸馏是每家实验室在自身模型上都会使用的、完全正常的训练技术。而整个事件被置于出口管制的叙事框架中。二月份的报告明确表示,如果不进行此类披露,中国实验室的进步会被误读为出口管制无效的证据,而实际上这些进展在很大程度上依赖于从美国模型中提取的能力。这是一个披着威胁报告外衣的政治论点。向世界点名七家中国公司服务于一个非常具体的叙事,而 Anthropic 则在其中扮演了负责任的角色。因此,实际情况是 Anthropic 观察到了流量,自行做出了归因判断,保留了底层元数据(我理解出于安全原因),然后在一份明确与国家安全框架挂钩的文件中公开点名了一家公司。一些实验室尚未回应,但沉默并非承认。公众无法验证任何内容。如果他们真的拥有将元数据匹配到具名 Qwen 研究人员的证据,本可以隐去姓名并展示证据链。但他们没有。他们展示了罪行,然后断言了罪犯。我并非说 Qwen 没有问题。我没有这样说。我的意思是,这是一个重大的指控——基本上是指控全球最大的 AI 公司之一窃取了来自美国竞争对手的推理能力——而其公开证据仅是一句话和一个时间上的巧合。在看到实际证据之前,我无法接受这个说法。而新闻标题的写法「Anthropic 点名七家中国实验室」,让所有七家听起来证据同等确凿,但报告本身对它们的处理却截然不同。报告中证据最有力的案例,也是唯一一个实验室被查出持有自身客户数据的案例。如果 Anthropic 想让出口管制论点成立,那么其归因也需要同样经得起推敲。目前,就 Qwen 而言,公开记录中的只是一个声称。
查看原文

相似文章

The request was rejected because it was considered high risk

X AI KOLs Timeline

Anthropic的报告详细揭露了外国间谍、黑客及AI公司滥用Claude进行间谍活动、欺诈及非伦理模型训练的情况,并指控阿里巴巴和DeepSeek等机构存在盗用及洗白响应内容的行为。

等等,什么?

Reddit r/artificial

阿里巴巴已禁止使用Anthropic的Claude Code,而Anthropic正在追踪中国用户,这凸显了AI监管和数据隐私方面的紧张局势。