首页 > 资讯 > Anthropic指控阿里、月之暗面与DeepSeek发起模型蒸馏攻击

Anthropic指控阿里、月之暗面与DeepSeek发起模型蒸馏攻击

赢政天下 2026-09-11 06:25 2 阅读 查看原文
Anthropic指控阿里、月之暗面与DeepSeek发起模型蒸馏攻击

编者按:模型蒸馏本是学术界常见的模型压缩与知识迁移手段,但当它被用于低成本复刻竞品能力时,就变成了大模型时代最难界定的灰色地带。Anthropic最新发布的报告,把这一争议推到了中美AI竞争的风口浪尖。

Anthropic点名三家中国AI公司

据TechCrunch报道,Anthropic于本周四发布一份新报告,指控来自中国的AI公司对其模型发起“持续性的蒸馏攻击”,并点名阿里巴巴、月之暗面(Moonshot AI)与DeepSeek三家企业。报告称,这类行为并非偶发,而是在过去数月间随着全球大模型竞争白热化而不断升级。

Anthropic在报告中强调,蒸馏攻击的核心特征是“规模化”与“自动化”——攻击方通过大量构造的提示词(prompt),系统性地收集目标模型的输出,再将这些输出作为训练数据,用于训练和优化自己的模型。这一过程在API层面看起来与正常调用无异,但在数据层面却相当于把竞争对手的模型能力“搬运”到了自己的模型里。

报告称,相关蒸馏行为“持续存在”,并在近几个月随着行业竞争加剧而进一步升级。

什么是“模型蒸馏攻击”

在机器学习领域,知识蒸馏最初是一种正当的技术:让一个体积小、成本低的“学生模型”去模仿一个庞大“教师模型”的输出分布,从而以小得多的算力获得接近的效果。问题出在“教师模型”属于他人时。

当一家公司调用竞争对手的付费API,把海量问答结果保存下来用于训练自家模型,这在道德与合同层面就构成了争议。它不同于直接窃取权重或源代码,因为攻击者获取的是模型的“行为”,而非模型本身。正因如此,这类行为长期游走在技术中立与不正当竞争之间的模糊地带。

这也不是第一次有美国AI公司公开指控中国企业。此前OpenAI曾表示掌握证据,认为DeepSeek可能通过API蒸馏其模型能力;微软与OpenAI也曾联合调查相关账号的异常调用行为。Anthropic此次的不同之处在于,它以正式报告的形式,将指控对象具体化、系统化。

为什么是现在

时间点本身就颇具意味。一方面,全球头部模型的能力差距正在收窄,中国团队以远低于美国同行的训练成本推出高性能模型,令“效率优势”成为行业最热门的话题。如果这一效率部分来自对竞品输出的学习,那么关于“成本领先”的叙事就需要被重新审视。

另一方面,Anthropic自身也处在商业与政策两条战线上。作为Claude系列模型的开发商,它需要向投资者和客户证明自身技术护城河的稳固;而在华盛顿,围绕算力出口管制与AI安全监管的讨论正酣,一份指向具体中国企业的报告,天然具备政策层面的分量。

法律与治理的模糊地带

从法律角度看,蒸馏攻击的追责难度极高。服务条款通常禁止使用输出结果训练竞争模型,但这属于合同纠纷,取证与跨境执行都极为困难。版权法能否覆盖模型输出,各国司法实践尚未形成共识;而商业秘密或不正当竞争的主张,则需要证明实质性损害,门槛同样不低。

技术层面的反制也在演进。模型供应商可以嵌入水印、部署指纹识别、监测异常调用模式,甚至对输出做轻微扰动以污染蒸馏数据集。但这些手段往往与用户体验和API定价策略相冲突,难以大规模推行。

对行业意味着什么

可以预见,这份报告会进一步推动美国AI公司在对华技术议题上的政策游说,也可能促使更多厂商收紧API使用条款、加强对异常调用的监测。对中国团队而言,如果蒸馏指控持续发酵,不仅可能面临服务封禁与法律风险,还可能在国际市场信任度上付出代价。

但更值得关注的,是这场争论暴露出的行业结构性问题:当模型能力可以低成本地被“复制行为”时,投入巨资研发的实验室该如何获得回报?技术领先的优势窗口究竟能维持多久?这些问题没有简单答案,而Anthropic的这份报告,只是把矛盾更直白地摆上了台面。

本文编译自TechCrunch