在阅读此文之前,辛苦您点击一下“关注”,既方便您进行讨论和分享,又能给您带来不一样的参与感,感谢您的支持!
编辑:
[免责声明:]文章的时间、过程、图片均来自于网络,文章旨在传播正能量,均无低俗等不良引导,请观众勿对号入座,并上升到人身攻击等方面。观众理性看待本事件,切勿留下主观臆断的恶意评论,互联网不是法外之地。本文如若真实性存在争议、事件版权或图片侵权问题,请及时联系作者,我们将予以删除。
2026年3月23日,中国发展高层论坛年会上,国家数据局局长刘烈宏说了一个词——“词元”。
全场都明白这意味着什么:AI时代最核心的计量单位Token,终于有了官方中文名。

同一天,全国科学技术名词审定委员会发布公告,优先推荐“词元”作为Token的中文名,面向全社会试用。表面上看,就是一个英文单词有了中文翻译。可这事远远没这么简单。
人民网8月5日发了篇锐评,标题叫《用“Token”还是“词元”,事关科技话语权》。话说到这个份上,分量已经摆在那儿了。

Token这个事儿,很像60年前那场争论。1960年代,激光技术刚进中国。大陆叫“来塞”,台湾叫“镭射”,还有七八个字的译名。
学者交流得反复解释“来塞”和“镭射”是同一个东西。更离谱的是,有人以为“镭射”跟放射性元素“镭”有关,吓得不敢碰。

1964年,钱学森反复斟酌后一锤定音——叫“激光”。一个名字定了,产业标准才有了,公众认知才有了。
今天的Token,处境跟当年的激光一模一样。Token已经不只是技术圈的“黑话”了。它是大模型调用的评估标准,是厂商卖套餐的计费单位,是AI经济的“度量衡”。

没有统一的中文名,学术交流、产业协作、公众科普全得卡壳。一个产业要长大,连名字都叫不统一,这楼怎么盖?
“词元”这俩字不是拍脑袋想出来的。2021年,复旦大学计算机科学技术学院教授邱锡鹏就把Token译成了“词元”,写进了教材。学界接了这个说法,慢慢传开了。
为啥叫“词元”?

“词”,点明它源于语言处理场景,跟语义、文本有关。“元”,在中文里天然指向最小的、不可再分的基础单位。更妙的是,“元”还是货币计量单位——对应了Token作为AI时代“新货币”的概念。
从2024年初到2026年3月,中国日均Token调用量从1000亿飙到140万亿,两年增长超千倍。一个词从教材走进国家数据局局长的演讲稿,背后是14亿人每天用出来的。

官方定了“词元”,可争议远没结束。
有人不服。清华教授杨斌在3月18日发文,提议把Token译为“模元”。理由很直接——“词”字被锁死在文本场景,没法适配多模态、物理AI这些新形态。“模”对应大模型、多模态,谁拥有大模型谁就掌握“模元”的生产权。

还有AI媒体“新智元”和百川智能创始人力推“智元”。“智”才能体现它服务于智能计算的本质。
一个名字之争,炸出了不同派系对AI本质的理解差异。搞文本的说“词”,搞多模态的说“模”,搞智能的说“智”。谁的名字被采纳,谁的认知框架就占了上风。

这不只是翻译问题,这是定义权之争。为什么官方最终选了“词元”?
一位评论者说得好:“一个词一旦变成了钱的度量衡,给它起名就不是翻译,是铸币。”“词元”最大的优势恰恰是它的朴素——不预设立场,不替任何商业叙事站台。

叫“智元”等于官方认定Token的本质是“智能”,这在学术上有争议。叫“模元”等于把整个产业叙事绑定在大模型上,而技术路线随时可能迭变。“词元”只是忠实地描述了Token最基础的功能。
浙江省原政协副主席周国辉点破了一个关键——这事关乎每个人的“AI钱包”。AI按Token收费,就像交电费按“度”、用流量按“兆”。
可中文在Token计费上天然吃亏,同一句话,英文可能切出几个Token,中文可能被切成更多根据行业共识,中文文本中1个词元约对应1.5至2个汉字,1000个词元大致相当于500至700个汉字。

这意味着中文用户可能在不知不觉中支付更高的“词元成本”。谁定义了Token怎么切、怎么算,谁就定义了AI经济的底层逻辑。
法国思想家福柯说过一句话,“话语即权力”。命名是权力主体对现实进行分类、界定和占有的方式。Token叫“词元”还是叫“模元”,不只是语言学问题,是谁来定义AI时代的“度量衡”问题。

人民锐评说得更狠:长期依附外来术语、照搬西方语言逻辑,会让我们的科技认知局限于既定框架中。
核心概念的定义权、阐释权如果始终掌握在别人手里,中国特色科技话语体系就无从建立。这种认知层面的依附,比技术差距更隐蔽。

回头看历史,类似的事不是头一回。
1990年代,“Internet”进中国。直译“因特网”,还有“信息网络”“上网”各种叫法。反复讨论之后,“互联网”定了下来,深刻影响了中国网络空间的认知框架。

“Chip”也是,“芯片”和“晶片”争了半天,“芯片”胜出。对应的是中国大陆在半导体产业话语体系中的主体性确立。一个关键术语的本土化命名,往往是技术主权意识觉醒的前奏。
今天的Token定名“词元”,走的也是同一条路。国家数据局局长亲自在高层论坛上给译名,这本身就把一个技术术语的翻译,提升到了国家战略话语建构的高度。

2023年以来,国家数据局等17门联合印发《“数据要素×”三年行动计划》,《生成式人工智能服务管理暂行办法》实施。再加上“词元”定名,中国在AI领域从政策到话语,正在系统性地构建自主体系。
5月22日,国家数据局召开词元经济座谈会,明确将推动词元经济发展纳入工作体系。国家统计局首次在国民经济运行情况发布会上引述“词元”调用量数据。2026年4月,国家数据局就相关方案征求意见,首次提出“探索以词元为基础的价值体系”。

从定名到纳入统计到建立经济体系,“词元”正在从一个技术术语变成中国经济的新“体温计”。
“词元”这个名字定了,可争议还在。
有人说“词元”被“词”字锁死,适应不了多模态时代。有人说“模元”更符合AI大模型、智能体的内涵。每一种说法都有道理。可名字一旦定了,关键就不是吵,是用。

人民锐评说得很清楚:国际学术交流、跨国合作中保留英文原词没问题。但在国内公共传播、教育教学、政策普及这些场景里,必须大力推广“词元”“智能体”等标准中文译名。
从“电脑”到“互联网”到“芯片”到“词元”,每一个外来技术概念的本土化命名,都是中国在科技话语体系里一步步站稳脚跟的脚印。

国家数据局局长刘烈宏说,“词元”不仅是智能时代的价值锚点,更是连接技术供给与商业需求的“结算单位”。
名字是小事,可名字背后的话语权,从来不是小事。

兄弟们,你们觉得“词元”这个译名怎么样?评论区聊聊。
信息来源:


更新时间:2026-08-11
本站资料均由网友自行发布提供,仅用于学习交流。如有版权问题,请与我联系,QQ:4156828
© CopyRight All Rights Reserved.
Powered By 61893.com 闽ICP备11008920号
闽公网安备35020302034844号