Y Combinator 首席执行官 Garry Tan 表示,他不赞成美国对从事模型蒸馏的中国公司采取打击行动,反而认为美国应当考虑建立自己的蒸馏机制。这一表态与美国硅谷部分企业和国家安全专家近来要求对中国相关企业采取行动的呼声相反。
蒸馏指利用能力更强的AI模型的输出,训练规模更小或能力更弱的模型,这种做法的合法性存在争议。Anthropic 指控中国公司 Moonshot AI、DeepSeek 和 MiniMax 从事此类行为;OpenAI 则认为 DeepSeek 的 V3 和 R1 模型架构系从其 GPT-4 和 GPT-4o 模型蒸馏而来。据 CNBC 报道,硅谷巨头和国家安全专家正呼吁对中国从事模型蒸馏的公司采取行动。
美国国家安全局、网络安全和基础设施安全局以及联邦调查局于周二就此发布了一份官方网络安全警告。
Tan 说:“我什么也不会做。”他表示:“我们大可以说,应该存在一套美国的蒸馏制度。”在他看来,监管者不应把重点放在遏制蒸馏上,而应着力在开放权重模型与前沿模型之间建立平衡,前提是前沿模型保持价格溢价,使其商业模式仍然可行。他说:“这其实是最理想的情况。你希望开放权重模型给人们自由和获取渠道。如果我是监管者,那才是我要追求的目标。”Tan 承认这一平衡很难把握,称其犹如“走钢丝”,但仍值得追求,因为这“可能带来最好的结果”。
Tan 后来对 TechCrunch 表示,他希望美国拥有更多非中国的开放权重选项,由规模较小的美国开放权重AI实验室,运用同样的训练技术,在美国前沿AI实验室的产品之上构建。Anthropic 首席执行官 Dario Amodei 此前曾公开呼吁美国监管者打击蒸馏行为。
Tan 并不主张美国AI实验室使用窃取的凭证进行蒸馏,而是希望它们能够“从前门进来”。他的论据有两点。其一,他认为AI实验室规定客户可以如何使用模型提供的信息,属于越权。其二,他指出专有AI实验室在尽可能多地吸收人类知识用于训练模型时,并未征求许可,其中包括大量未经知识产权持有者许可而使用的受版权保护材料。他对 TechCrunch 说:“控制用户和客户对闭源权重模型的API调用做什么,让人感到受限。政府在这里可以发挥作用,让这样一件事正常化:对基于广泛公开获取的数据训练出的智能的获取,本身也应当更接近一种公共产品,而不是被锁在限制性的服务条款之后。”
在 Tan 看来,真正的AI末日场景是前沿AI的全部巨大能力落入单一而强大的专有提供商手中。他说:“AI的噩梦场景、末日场景就是只有一家公司。它拥有最好的资本渠道,拥有最好的AI研究人员,它一路领先,突然之间只剩下一家铁板一块的公司。那会很糟。”