路透社(Reuters)星期五(7月31日)发表的一项调查报道发现,与中国军方有关联的研究人员一直在利用美国OpenAI和Anthropic公司旗下领先的人工智能(AI)模型生成的内容,训练用于国防用途的国内AI系统。
路透社对80多篇中国学术论文和专利的审查发现,一种被称为“模型蒸馏”(model distillation)的技术已被广泛使用--即利用一个强大AI系统生成的输出内容,训练出规模更小、运行算力需求远低于前沿模型的专门化系统。报道说,这项审查所依据的研究由华盛顿智库詹姆斯敦基金会(Jamestown Foundation)汇编,并独家提供给路透社。
具体案例
路透社报道说,解放军96941部队--一支驻北京的军事情报与网络战部队--的研究人员去年发表的一篇论文描述了如何利用OpenAI的GPT-3.5处理敏感军用源代码。由于研究人员认为第三方模型不适合处理涉密信息,他们改用GPT-3.5对软件代码进行摘要处理,再用这些摘要训练出一个可完全在中国军方内部网络运行的国产模型。
路透社的调查还发现,据称与中国军工产业关系密切的位于山西太原的中北大学的研究人员曾利用Anthropic旗下的Claude 3 Haiku生成合成训练数据,用于开发一款针对社交媒体监控和内容审核的文本分类模型。
另据路透社审查的一篇2024年的论文,解放军国防科技大学的研究人员利用模型蒸馏技术,将一个图像处理模型压缩后部署到无人机上,使无人机即便在通讯中断的情况下,也能实时分析视频画面,为导航和瞄准决策提供支持。
路透社的报道还说,今年早些时候发表的一项研究,中国军事科学院的研究人员利用蒸馏技术,在模拟海上行动中将一个目标识别模型运行于战术硬件上,相关行动涉及无人机、舰船和无人潜航器。
各方回应
Anthropic对路透社表示,该公司不向中国或受北京控制的公司提供Claude的商业使用权限,并表示公司设有监测系统以侦测违规行为。该公司还说,被蒸馏的模型可能会失去原始系统内置的安全防护措施,从而可能使敏感能力被转移到公司无法掌控的模型当中。
美国之音(VOA)就路透社这项调查结果分别联系了OpenAI和Anthropic置评,截至发稿时,两家公司均未回应。
美国之音也就此向美国战争部请求置评。五角大楼一名发言人表示没有可以提供的信息。
中国政府否认有关中国企业不当获取美国AI模型能力的指控。中国商务部星期一指责华盛顿推行AI领域的“霸权主义”,并说美国企业本身也有类似做法。
在此之前,中国AI初创企业月之暗面(Moonshot AI)上星期否认了特朗普政府有关其Kimi K3模型是通过蒸馏美国系统开发而成的指控,该公司表示其技术进步是靠自主创新驱动的。
白宫科技政策办公室主任迈克尔·克拉西奥斯(Michael Kratsios)7月22日在社交媒体平台X上发文提出上述指控。他写道:“我们掌握的信息显示,月之暗面蒸馏了Anthropic的Fable,用于开发其K3模型。”他将此形容为“旨在窃取美国专有技术、破坏美国研究的大规模隐蔽工业化蒸馏行动”。
“蒸馏之争”聚焦未经授权的提取
路透社星期五的报道说,争议核心是未经授权的能力提取,而非蒸馏技术本身--蒸馏在行业内是被广泛使用的常规做法;美方官员指控部分中国实体借此规避出口管制、侵犯知识产权。这一议题已成为美中即将就AI治理与安全举行会谈前的焦点之一。
詹姆斯敦基金会研究员张昆阳(Sunny Cheung)分析了60多篇相关论文。他向路透社表示,中国军方科学家正系统性地捕捉西方模型的推理过程,试图将其转移到可自行掌控部署的小型系统中,用于监控、网络战和战术决策。
不过,专家提醒蒸馏模型仅能继承原始模型的部分能力。AI数据公司Sapien联合创始人特雷弗·科弗尔科(Trevor Koverko)对路透社表示,被蒸馏的模型仍弱于其“教师模型”,这一过程是转移选定能力,而非实现对前沿AI的独立自主。