美国政府周二指责中国人工智能(AI)公司“以工业规模恶意”蒸馏美国人工智能企业的前沿模型。这一指控可能会使美中领导人定于本月晚些时候举行的会晤面临更复杂的局面。

美中两国国旗资料图片
美中两国国旗资料图片 © 路透社图片

据美国执法和情报官员发表的报告,这些中国公司利用一种被称为蒸馏的技术,复制了美国人工智能实验室的知识产权。蒸馏是指利用规模更大、成本更高的人工智能模型的输出来训练较小人工智能模型的过程,旨在降低训练新型人工智能工具的成本。

美国官员指责包括DeepSeek、月之暗面(Moonshot AI)和阿里巴巴在内的六家中国公司,利用美国制造的人工智能模型的变体来加速训练其自身的人工智能产品。

美国国家安全局(NSA)、美国国土安全部下属的网络安全和基础设施安全局(CISA)及联邦调查局(FBI)联合发布的“网络安全警示报告”写道:“基于中国的人工智能公司正通过工业规模的知识蒸馏运动,系统性地提取美国人工智能公司模型所具备的专有功能与能力;此类行动构成了其人工智能发展战略的核心,而不仅仅是辅助手段。尽管‘蒸馏’在人工智能研究领域被认为是一种正当且有用的技巧,但基于中国的人工智能公司正开展激进的、恶意且具有针对性的工业级蒸馏活动,旨在提取美国前沿人工智能模型中受限的专有功能与能力”。

“网络安全警示报告”续称:“至少自2024年年底以来,DeepSeek、月之暗面、阿里巴巴、MiniMax、StepFun 和Z.AI在中国政府可能知情的情况下,从美国前沿人工智能模型——包括Claude、GPT、Gemini和Grok的变体中提取了数十亿个词元(Token)——涉及数百万次交互或请求。DeepSeek至少自2024年起便开展了有组织的运动,针对推理能力、专门优化及特定领域功能,以训练其R1和V3模型。阿里巴巴利用工业级规模的蒸馏来改进其千问(Qwen)系列 人工智能模型。月之暗面、MiniMax、StepFun和Z.AI也参与了针对美国人工智能公司模型的恶意知识蒸馏”。

该报告称:“针对美国人工智能模型开展工业级蒸馏活动的中国人工智能企业,在训练前沿模型时,其开发周期显著缩短,资金投入也大幅降低。这些基于中国的人工智能企业刻意将行动分散部署于多个服务提供商、平台及技术路径,以规避被单一监测点发现的风险。同时,它们试图提取美国各类前沿模型中最优异的能力与专有特性,以此来训练自身的人工智能模型。这种做法构成了对专有功能与能力的系统性提取,威胁到了美国的技术领先地位”。

美国官员提出上述指控之际,特朗普政府正为中国国家主席习近平于9月下旬访美做准备。据路透社此前报导,美中双方也正积极筹备,计划于9月中旬就人工智能安全风险展开对话。

北京方面,中国外交部发言人毛宁在周三的例行记者会上应询时表示,“具体的报告我没有看,但是我可以告诉你的是,中国人工智能的发展是高水平科技自立自强的成果,也得益于我们始终秉持共商、共建、共享和开放合作的理念,我们始终认为各方应当加强合作,推动人工智能开放包容、普惠、向善发展,服务全人类的福祉”。

毛宁续称:“我们希望美方能够认真地落实两国元首达成的重要共识,不要对中国进行不实的指责和抹黑。中美都是人工智能大国,应当加强合作”。

此前,美方曾在4月特朗普访华前夕提出过类似的指控。美方周二发表的报告指出,这种蒸馏不仅降低了中国人工智能企业的研发成本,还增强了中方“可用于针对美国及其盟友的军事和网络攻击能力”。

路透社7月31日报导称,中国军事研究人员利用美国顶尖人工智能模型的输出结果来训练中国本土的人工智能系统,并提升中国的国防能力。