
路透独家:中国军方关联研究人员,正在用OpenAI和Anthropic的模型训练本土军用AI。
路透审查了80多篇中国论文和专利,发现多家军方及国防研究机构,正在通过模型蒸馏,把GPT和Claude的输出转移到更小、更便宜、能够离线部署的国产模型中。
其中最敏感的案例,来自解放军96941部队。
研究人员认为,第三方模型不适合直接处理涉密信息,于是先使用GPT-3.5总结军事软件源代码,再用这些总结训练国产模型,最终将模型部署在中国军方内部网络中。
其他论文还涉及无人机实时视频分析、导航和目标判断,以及无人机、舰船和无人潜航器参与的海上模拟作战。部分研究机构还使用Claude 3 Haiku生成社交媒体监控模型所需的合成数据。
报道还引用研究人员的话,称这些论文显示中国军方正在系统性捕获西方模型的推理步骤,把昂贵的专有推理能力转移到本地模型中。
但公开举出的GPT-3.5案例只是代码摘要,Claude 3 Haiku案例只是生成分类数据。
两者都不是推理轨迹,也谈不上转移什么前沿推理能力。
模型蒸馏当然值得关注。
大规模抓取闭源模型输出,复制其商业能力,也确实可能涉及服务条款、知识产权和国家安全问题。路透自己也承认,争议核心是未经授权的大规模提取,而不是蒸馏技术本身。
但仅凭这篇报道公开的证据,最多只能得出:
部分中国军方及军工关联研究人员,曾使用GPT-3.5和Claude 3 Haiku生成训练数据。
把它包装成中国军方正在用美国前沿AI训练无人机和国防系统,基本属于把几个松散案例焊在一起,制造了一条地缘政治大新闻。
PS:能看出来路透根本不懂中国军工科研的相关制度。

中文
































