作者简介 叶欣
商务部国际贸易经济合作研究院数字贸易研究所所长
近日,美国部分高级官员公开表示,将对中国人工智能企业发起调查,理由是所谓中国企业通过“蒸馏”手段获取美国前沿模型的技术能力,并可能以“窃取知识产权”为由施加制裁。中国商务部新闻发言人已明确回应,指出美方此举“缺乏事实依据,没有法理支撑,在实践上搞双重标准,属于典型的人工智能霸权主义行径”。这不是一次孤立的技术性摩擦,而是一场精心策划的打压行动,其背后是美国面对中国人工智能强劲发展势头产生的战略焦虑,本质上是要以泛化国家安全概念为名、行遏制别国人工智能发展之实。
蒸馏是全球通用的模型压缩方法,是开放技术生态的组成部分
美方指控的蒸馏,是人工智能领域一项成熟的通用技术。2015年,杰弗里·辛顿在论文《Distilling the Knowledge in a Neural Network》中系统提出这一概念,至今已有十多年历史。其原理可以理解为:一个已经训练完成、性能优异的大型模型作为“教师”,将自身学到的知识映射给一个结构更为轻量的“学生”模型,使其在参数量大幅缩减的情况下,依然保持较高的任务完成能力。
这项技术自诞生以来便在全球产业界得到广泛应用。谷歌用BERT蒸馏出MobileBERT用于移动端部署,微软将蒸馏功能封装为DeepSpeed Compression的统一接口,OpenAI长期运用类似方法降低推理成本。在全球人工智能工程化实践中,蒸馏与量化、剪枝、低秩分解等方法并列,属于模型压缩工具箱中的标准配置。将一项公开通用技术污名化为“偷窃手段”,无异于指责使用标准数学方法的人在进行“知识剽窃”,既违背基本技术常识,也严重破坏了人工智能开放合作的全球共识。
值得指出的是,美国企业在研发和训练过程中同样广泛使用中国开源模型,通过蒸馏技术,增强自身产品竞争力。近两百家美国初创企业曾联名致函美国政府,警告切断与中国开源模型的联系将严重削弱美国企业竞争力。一些美国大型跨国企业也明确表示,蒸馏是行业广泛应用的技术,应当允许美国企业使用中国开源人工智能模型。这些来自美国产业界的理性声音,恰恰印证了技术流动的双向性和开放性。若依美方逻辑,对美国企业利用中国模型的行为又该如何定性?如此赤裸的双重标准,恰恰说明美方所依据的不是技术事实,而是打压别国发展的政治意图。
蒸馏无法创造新能力,中国模型领先靠自主创新
理解蒸馏的技术本质后,便自然明白,蒸馏可以传递已有能力,但无法凭空创造新能力。蒸馏做的是知识压缩和迁移,不是架构创新,不是从无到有的能力生成。中国人工智能模型当前在性能、效率、推理能力等方面表现出的竞争力,绝非蒸馏的产物,而是根植于大规模创新投入的结果。将中国AI的进步归因于对外模仿,既与基本技术逻辑相悖,也无视了中国在人工智能领域多年深耕所取得的扎实成效。
从整体创新规模看,根据世界知识产权组织数据,中国在生成式人工智能领域的专利申请量已占全球总量的77%以上。这不是模仿所能达到的规模,它反映的是一个涵盖基础研究、算法框架、应用场景在内的完整创新生态正在加速形成。正如中国商务部发言人所说,“创新不是任何一方的专利。中国人工智能企业长期深耕基础研究,坚持科技自立自强与开放合作并重,推动人工智能技术快速发展,在前端代码能力等越来越多的领域取得喜人成就。”
从具体技术突破看,中国企业的独创成果更是不胜枚举。以深度求索公司的模型为例。其在V2和V3版本中提出的MLA架构,即多头潜在注意力机制,是对Transformer底层注意力计算方式的一次深度革新。这一设计通过引入低秩压缩,在模型性能不降的前提下大幅减少了推理阶段的显存占用和计算开销,使得同等算力条件下能够支持更长的上下文和更高的并发。技术报告发布后,在国际学术界和工业界均引起广泛关注与讨论,不少海外研发团队已将其思路融入自身的技术迭代中。
能够引发同行主动借鉴,本身就是创新能力的体现。月之暗面公司的Kimi模型在超长上下文处理方面的领先表现,同样植根于原创性探索。其团队在强化学习训练策略、高效注意力计算、推理系统架构等方面进行了长期的工程积累,才使模型在处理数十万词元级别输入时仍能保持连贯的推理能力。这类能力无法通过蒸馏已有模型获得。蒸馏最多只能传递一个模型的输出分布,却无法复制其动态推理路径,更不可能在基础能力上实现代际跃升。
美方指控的实质是打压开源生态,维护其人工智能霸权
美方此番调查与制裁威胁的意图十分清晰,并直指一个核心问题,即谁将主导人工智能技术的全球普及。近年来,中国人工智能企业发布的一系列开源大模型,因性能出色、协议友好、部署成本可控,受到全球开发者社区的广泛欢迎。这种开源生态的崛起打破了长期以来由少数美国科技巨头以高昂API费用和闭源授权构建的商业模式,使得更多国家和中小企业能够以较低门槛获取先进AI能力。对于长期主导全球技术标准制定和定价权的美国而言,这种格局变化构成了对人工智能霸权的直接挑战。
美国的应对方式,是将商业层面的竞争失势重新包装为安全威胁。其国家安全总统备忘录中出现了防范“恶意蒸馏”这类生造概念,实质上是将技术术语政治化,为行政干预制造合法性外衣。具体来看:
一是将商业竞争政治化,滥用国家安全概念。美国部分政客近年来不断泛化国家安全概念,将中国在人工智能、5G、半导体等领域的技术进步一律渲染为安全威胁,以此为借口采取出口管制、投资审查、实体清单等一系列打压措施。如今,连“蒸馏”这一公开的通用技术也被纳入了国家安全叙事框架,其背后的逻辑是,凡是可能增强中国科技竞争力的,无论是否符合国际规则,都可能被贴上安全标签加以限制。
二是打压中国开源大模型的全球崛起。中国开源模型的成熟,为全球开发者提供了一条无需支付高昂授权费、可以自主部署和二次开发的替代路径,使更多国家和中小企业得以跨越曾经难以逾越的技术门槛。对于长期主导技术标准制定和定价权的美国企业而言,这种变化不仅仅是市场份额的流失,更是其整个闭源商业逻辑和发展模式面临的深刻挑战。正因如此,美方才急于将蒸馏这个技术环节单独拎出来大做文章,将其塑造成威胁,其真正目的是希望通过破坏开源生态,延缓乃至扼杀中国开源大模型的国际竞争力。
三是维护自身在人工智能领域的技术垄断地位。美国在人工智能领域起步早、积累厚,长期处于产业链顶端。然而,随着中国等国家持续加大研发投入,技术差距正在缩小,在某些细分领域甚至实现了反超。面对这一局面,美方不是通过强化自身创新来巩固优势,而是反复动用国家力量打压任何可能对其技术垄断地位构成挑战的对手。这种做法不仅违背市场公平竞争原则,也严重破坏了人工智能合作基础。
习近平总书记在2026世界人工智能大会开幕式主旨讲话中深刻指出:“人工智能发展不应该是某个国家的独奏,而应当是全球合作的交响。”这道出了人工智能这一全人类共同智慧结晶应当遵循的发展方向。
作为负责任大国,中国始终坚持发展安全并重,在人工智能领域既是积极实践者,也是国际公共产品的重要提供者。中方先后推动联合国大会协商一致通过人工智能能力建设国际合作决议,发布《人工智能能力建设普惠计划》和《“人工智能+”国际合作倡议》,倡议成立世界人工智能合作组织,以实际行动推动全球人工智能向着向上向善的方向发展。
美方的调查威胁和制裁大棒,不仅无助于自身创新能力的提升,也将对全球人工智能技术交流与产业合作造成负面影响。美方应倾听两国业界的客观理性声音,纠正霸权思维,停止对中国企业的抹黑和制裁威胁,同中方相向而行,加强人工智能对话沟通,共同推动人工智能向上向善,引领人工智能技术真正成为增进全人类福祉、推动人类文明进步的强大正能量。
责任编辑:柴晶晶
版权所有 中国外文局亚太传播中心(人民中国杂志社、中国报道杂志社) 举报电话: 010-68995855 举报邮件: chinareport@foxmail.com 法律顾问:北京岳成律师事务所
广播电视节目制作经营许可证:(京)字第07311号 互联网出版许可证:新出网证(京)字 189号 京ICP备14043293号-10 京公网安备:110102000508