
文 | 谷子
每日解读国际事务
仅供交流学习
这两天科技圈出现了一个相当分裂的景象。
一边是美国高级官员公开宣称,中国人工智能企业“蒸馏”了美国前沿模型,属于“窃取知识产权”,威胁要发起调查和制裁。
另一边,近200家美国初创企业联名致信白宫,敦促政府不要切断美国开发者对中国开源AI模型的访问。
同一个“蒸馏”,在美国政客嘴里是偷窃,在美国创业者眼里却是活命的氧气。
如果一个行为在A那里是犯罪,在B那里是救命稻草——那这个行为本身到底是什么性质,就值得从头捋一捋。

一、蒸馏不是偷,是听写大神的口述自己组句子
先搞明白“蒸馏”到底是什么。
2015年,图灵奖得主辛顿正式提出了知识蒸馏技术。原理很简单:一个参数量巨大的“教师模型”训练好了,用它去指导一个轻量化的“学生模型”,学生模仿老师的输出分布,继承泛化能力和推理逻辑,同时大幅减少参数规模和计算成本。
打个比方。一个班有两个学生。大学霸做了一套卷子,思路写得很详细。小学霸看了大学霸的解题过程,没抄答案,而是自己重新推了一遍,写出了更简洁的解法。
你不能说小学霸“偷”了答案,逻辑是他自己推的,步骤是他自己写的。

美国自己的业界也承认这一点。一些美国大型跨国企业公开表示,模型蒸馏是行业广泛应用的技术,应允许美国企业使用中国开源人工智能模型。
商务部发言人的回应说得很直接:美方罔顾中国企业AI模型与美前沿模型发布时间非常接近、中国部分模型能力已处于领先地位等事实。这些做法“缺乏事实依据,没有法理支撑,在实践上搞双重标准”。
逻辑上有个最基本的漏洞:如果中国AI模型真的是靠“蒸馏”美国模型才做出来的,那发布时间应该晚于美国模型才对。
但现实是,双方发布时间非常接近,部分领域中国还领先。你没法“蒸馏”一个还没发布的东西。

二、显卡焦虑:厨房只有一口小锅,但要做满汉全席
真正让美国睡不着觉的,不是谁“偷”了谁的模型,而是中国正在用更少的钱、更少的显卡,跑出差不多的效果。
先看美国AI的玩法。英伟达H100显卡,单卡售价2.5万到4万美元。H200售价3万到4万美元。单卡功耗700瓦。
训练一个大模型,动辄几千上万张卡同时开工,电费一天就是几十万美元。Meta训练Llama-3用了超过16000块H100,单是硬件投入就超过5亿美元。

这就像开了一家餐厅。厨房设备全球最贵,一个灶台几万美元,厨师团队几百人,电费账单吓死人。菜品确实好,但成本高到只有少数人吃得起。
再看中国AI的玩法。显卡没那么充裕,那就在算法效率、模型架构上死磕。追求的是“每一块钱算力掰成两半花”。
有的团队用国产GPU跑千亿参数模型训练,有效训练时长占比超过90%,训练损失曲线与国际主流计算卡高度一致。
结果呢?摩根士丹利的数据显示,中国AI芯片自给率从2021年的约10%飙升到2026年的41%,四年时间份额翻了3倍。
彭博行业研究预测,未来12个月中国企业采购AI芯片时,国产芯片在算力预算中的占比将从目前约30%攀升至46%。到2030年这个数字可能冲到86%。

美国建了一座全球最贵的显卡收费站,结果中国队不走收费站了,我们自己修路。
这种局面让人想起上世纪80年代美日半导体之争。1985年,美国半导体行业协会向美国贸易代表办公室提起301条款起诉,指控日本半导体倾销。
此后美国连续发起调查,迫使日本签署《1986年美日半导体协议》,接受出口价格指导和市场份额计算方法。在所有情况下,都以日本“屈服”的形式解决。

但历史没有简单重复。当年日本选择的是“在既有规则下让步”——接受美国定的份额、接受价格指导。结果是日本半导体产业从巅峰滑落,市场份额被美国重新夺回。
今天的中国走了一条不同的路:不在你定的赛道上跟你比谁跑得快,而是直接换赛道。
你卡EUV光刻机,中国用405纳米普通蓝紫光配合双光束超分辨技术打出5到7纳米线条,不用EUV照样做纳米级加工。你卡高端显卡,中国在算法效率和架构创新上找突破。
所以“蒸馏是偷窃”这个说法,本质上是一块遮羞布。真正让美国如临大敌的,是中国用十分之一的成本、三分之一的显卡,做出了可以掰手腕的模型。

三、最讽刺的反转:美国企业在拼命保护中国模型
反转来了。
就在美国政客高调宣布要调查制裁的同一天,近200家美国初创企业通过新成立的“小科技协会”联名致信特朗普政府。联名方包括知名孵化器Y Combinator、加密通信公司Proton等。
这些企业说了什么?核心就一句话:不要切断美国开发者对中国开源AI模型的访问。

小科技协会执行总监打了个比方:政策制定者应该“使用手术刀,而不是大锤”。翻译一下:你一刀切下去,砍的不是中国AI,砍的是美国自己的初创生态。
更值得琢磨的数据来了。据AI模型聚合平台OpenRouter统计,美国企业调用中国模型产生的词元总量占比已接近60%。也就是说,美国开发者用中国开源模型的频率,已经超过了用美国本土模型的频率。
英伟达CEO黄仁勛也公开表示,“优秀的开源模型理应得到应用”,低成本模型会扩大AI应用范围,反而拉动对芯片和算力的需求。
商务部发言人在回应中也提到了这一事实:“据了解,很多美国人工智能企业在研发和训练中蒸馏了中国的模型。”
所以,美国政客说:中国在“蒸馏”美国模型,是偷窃,要制裁。
美国业界用行动回答:我们也在用中国模型搞研发,中国模型救了我们的命,你不能切。

结语
依我看,算力成本正在经历一场静默的重构,国产AI芯片自给率从2021年的约10%飙升到2026年的41%,到2030年可能冲到86%。
瑞银的数据同时显示,中国头部模型的训练成本已经只有海外龙头的十分之一,推理端定价只有海外可比模型的10%到20%。
当芯片变便宜、算法更高效、国产替代从“备胎”变成“主力”,三个变量同时改善——训练一个千亿参数模型的成本从几千万美元降到几百万人民币级别,这件事不需要等太久。
未来18个月,算力就会从“奢侈品”变成“日用品”。
与此同时,美国对华AI制裁如果落地,最先倒下的不是中国企业。近200家美国初创企业已经用联名信给出了答案:他们依赖中国开源模型活着。切断访问,几百家美国公司要么倒闭,要么被少数大厂收购。

美国AI不会更安全,只会更垄断。这是美国创业者自己说的,禁令只会“让少数美国AI巨擘获得更大优势,甚至催生垄断”。
国产GPU替代的速度比多数人预想的更快。摩尔线程2026年7月在万卡集群上完成了MoE-236B基础模型从零起步的全流程训练,有效训练时长占比超过90%,训练损失曲线与国际主流计算卡高度一致。
当国产芯片的训练效率达到工业生产级要求,当美国初创企业离不开中国开源模型——制裁这件事就变成了一道算术题。
你算一下封锁会损失多少,再算一下封锁能阻止多少,答案不需要别人给。
历史反复证明:封锁从来挡不住技术创新。它只会让被封锁的一方跑得更快。
参考资料:央视新闻,新京报
更新时间:2026-07-31
本站资料均由网友自行发布提供,仅用于学习交流。如有版权问题,请与我联系,QQ:4156828
© CopyRight All Rights Reserved.
Powered By 71396.com 闽ICP备11008920号
闽公网安备35020302034844号