美国国家安全局(NSA)、网络安全与基础设施安全局(CISA)和联邦调查局(FBI)9月9日联合发布网络安全公告,指认DeepSeek、Moonshot AI、阿里巴巴、MiniMax、StepFun和Z.AI等六家中国AI企业自2024年底以来实施“工业规模”的模型蒸馏活动,从美国前沿模型中提取专有功能与能力。美方称,此类行为威胁美国技术领导地位。
公告称,上述企业从Anthropic的Claude、OpenAI的GPT、Google的Gemini和xAI的Grok等系列模型中,通过“数百万次交流与请求”提取了“数十亿个token”。蒸馏本是人工智能研究中的一种常见技术,可用大规模预训练模型的输出来训练更小的模型,但美方在公告中将此处的行为定性为“攻击性、恶意且有针对性的”。公告显示,涉事企业通过多个账户、不同API入口、多家云服务商、第三方AI聚合平台、代理服务和“中转站”,并共享开发者付费订阅,以规避防御机制。
公告列举的具体案例包括:DeepSeek据称使用上述美国模型的输出数据训练其开源推理模型R1;Moonshot AI从Anthropic的Claude Fable模型中提取“大量”数据用于训练Kimi K3,其Kimi K2据称使用了GPT-4o的数据。Claude Fable是Anthropic为公开部分最先进网络安全模型Mythos的能力而推出的,Mythos原本仅向Project Glasswing参与者开放。美方还称,这些蒸馏活动很可能在中国政府知情的情况下发生,但公告未明确指其得到政府支持。
为应对这一局面,CISA、NSA和FBI向美国AI企业提出多项建议:持续检测异常及恶意的提示词、账户、网络和行为,监控订阅使用比例、新账户即时最大用量及企业级吞吐模式;对疑似恶意蒸馏的请求“巧妙改变回答内容”,以削弱实施者的收益;建立跨组织情报共享机制,在模型供应商、云平台和API聚合商之间开展关联情报共享。
此前,OpenAI曾表示与微软一起封禁涉嫌“蒸馏”其技术的账户,Anthropic也在今年早些时候指控DeepSeek、Moonshot和MiniMax开展大规模蒸馏。此次由三家美国联邦安全与执法机构联合发布公告,使针对中国AI企业模型蒸馏活动的争议进入官方安全议程。