美国指控六家中国AI企业“工业规模”蒸馏美国模型

0
44

美国时间9月8日,美国联邦调查局(FBI)、国家安全局(NSA)和网络安全与基础设施安全局(CISA)联合发布网络安全通告,指控包括DeepSeek、阿里巴巴、月之暗面(Moonshot AI)、MiniMax、阶跃星辰(StepFun)和智谱(Z.AI)在内的六家中国人工智能企业,自至少2024年底以来通过大规模调用美国先进人工智能模型,获取其输出并开展所谓“模型蒸馏”(distillation)活动,以加快自身AI模型的开发。

路透社9月8日报道称,美国政府指责这些中国企业利用一种被称为“蒸馏”的技术复制美国人工智能公司的技术,并称相关活动可能得到中国政府知情。美国三家安全机构则将其描述为“具有攻击性、恶意且有针对性的工业规模蒸馏活动”。

根据美国方面的说法,所谓“模型蒸馏”,是利用一个规模更大、成本更高的AI模型产生的输出,训练另一个模型,从而降低训练成本并加快新模型的开发。美国安全机构称,中国企业通过大量请求美国商业AI模型,提取了数十亿个tokens,并利用这些输出训练和改进自己的模型。美国方面称,相关活动涉及包括Anthropic的Claude、OpenAI的GPT、谷歌Gemini以及SpaceX的Grok在内的美国先进AI模型。美国政府认为,这种做法不仅能够帮助中国企业降低研发成本、缩短技术追赶时间,而且可能进一步增强中国的军事和网络攻击能力。

路透社指出,美国政府此次指控正值特朗普政府准备迎接中国国家主席习近平9月底访美之际。美国和中国还计划在9月中旬举行有关人工智能安全风险的对话,因此此次针对中国AI企业的指控可能进一步增加两国在人工智能领域的紧张关系。路透社此前还报道,美国政府早在今年4月就曾对中国企业利用美国AI模型进行蒸馏提出类似指控。

不过,模型蒸馏本身并不是一种违法或罕见的技术。《华尔街日报》9月8日在一篇专门分析此次争议的报道中指出,蒸馏是人工智能行业普遍使用的一种技术路径,在使用开源模型或者企业自身模型的情况下,这种做法完全可以是正常的研发方式。真正引发美国政府担忧的是,中国企业是否通过违反美国AI公司的服务协议、使用大量账号或者其他方式,大规模获取商业模型的输出,再利用这些输出训练自己的模型。《华尔街日报》因此将争议焦点概括为:问题并不在于“蒸馏”这一技术本身,而在于企业是否通过未经授权的方式从专有模型中提取能力。

美国方面此次还将相关行为与知识产权保护联系起来。路透社报道称,美国官员认为,中国企业利用美国模型进行蒸馏不仅可以减少研发投入,还可能帮助中国AI企业更快缩小与美国领先模型之间的技术差距。美国方面甚至警告,如果相关行为被认定为知识产权盗用,未来可能采取包括制裁以及将相关企业列入实体清单在内的措施。

中国方面则对美方指控予以强烈反驳。美联社(AP)9月9日报道称,中国商务部将美国方面的指责称为“毫无根据”,并批评美国试图垄断人工智能产业。中国外交部也表示,中国人工智能的发展来自自身科技实力,并敦促美国停止所谓“虚假指责和抹黑”。中国方面同时强调,人工智能技术的发展应当加强国际合作,而不是人为设置障碍。

美联社还指出,此次争议发生在中美两国准备就人工智能安全展开进一步对话之际。美国方面担心中国企业利用美国领先模型的输出快速追赶,而中国则认为美国正在以国家安全和知识产权为由,对中国人工智能企业实施新的技术限制。随着中美领导人计划于9月底举行会晤,人工智能以及两国在这一领域的竞争与安全问题预计将成为双方讨论的重要议题。

值得注意的是,美国三大安全机构的联合通告使用了非常强烈的措辞,称中国企业的相关活动具有“攻击性、恶意性和针对性”,并且达到“工业规模”。但目前这些内容主要仍属于美国政府及其安全机构对相关企业行为的指控,并不意味着有关企业已经被法院认定实施了知识产权盗窃。

与此同时,围绕模型蒸馏的法律和技术边界仍存在争议。如果企业合法购买并使用模型输出,何种程度的模型蒸馏属于正常技术开发,何种情况下则构成违反服务协议、侵犯知识产权或其他违法行为,仍是美国AI行业和政策制定者正在讨论的问题。

 

作者