一份措辞严厉的指控报告
2026 年 2 月 23 日,Anthropic 发布了一份题为《Detecting and preventing distillation attacks》(检测与防范蒸馏攻击)的公开报告,指控三家中国 AI 实验室——DeepSeek、月之暗面(Moonshot AI)与 MiniMax——对自家 Claude 模型发起了”工业规模”的蒸馏攻击。
报告披露,这三家实验室通过约 24,000 个欺诈账号,与 Claude 进行了超过 1600 万次对话,目的是系统性地提取 Claude 的能力,用于训练和改进它们自己的模型。Anthropic 表示,公司以”高度置信”确认了攻击者的身份,依据包括 IP 地址分析、元数据以及来自行业合作伙伴的佐证信号——这些合作伙伴在自家平台上也观察到了类似行为。
什么是”蒸馏攻击”
模型蒸馏本身是机器学习领域的常规技术:用一个更大、更强的”教师模型”的输出,来训练一个更小的”学生模型”。但 Anthropic 认为,本次事件的规模与手段已经越过了界线。
- 代理网络掩护:攻击者使用代理网络批量创建和运营账号,掩盖真实位置与身份,绕开平台的防护机制。
- 目标明确:被提取的主要是 Claude 最有价值的能力,包括智能体任务执行、工具调用、代码编写、数据分析与逻辑推理。
- 强度持续升级:Anthropic 在报告中警告:”这些行动在强度和复杂程度上不断增长,采取行动的窗口期很窄,威胁超出了任何一家公司或任何一个地区。”
并非孤立事件
值得注意的是,就在两周前的 2 月 12 日,OpenAI 也曾公开披露过类似的发现,并点名 DeepSeek 与试图蒸馏其模型的行为有关。两家美国头部 AI 公司在半个月内先后发声,让”蒸馏”从技术话题变成了地缘政治话题。
华盛顿方面对这类事件高度敏感。美国政策制定者一直在担忧,中国公司是否正在借助美国建造的系统”弯道超车”。连续两起指控,无疑会进一步收紧美国对 AI 技术流动的审查。
影响与展望
对 Anthropic 而言,公开点名是一种威慑:既向攻击者发出警告,也向行业展示其检测能力。对 DeepSeek、月之暗面和 MiniMax 而言,这些指控若坐实,可能面临更严格的平台封禁与国际合作限制。
更深层的信号是,中美 AI 竞争已经从算力、模型性能的比拼,蔓延到了”模型能力本身是否会被复制”的攻防战。蒸馏攻防很可能成为未来几年 AI 安全领域的长期战场——而这场战争,才刚刚开场。