前段时间 OpenClaw 火了,大家叫它「小龙虾」。随着 OpenClaw 等 Agent 工具走红,越来越多普通用户开始从网页聊天接触到 API Key、模型供应商和按量计费等原本更偏开发者圈子的概念。大众开始更多地主动学习如何让 AI 从会聊天到会办事。面向普通用户的聊天产品往往提供免费额度(例如 ChatGPT、Claude),甚至可以免费使用(例如豆包、DeepSeek、智谱清言),而到了模型平台的后台控制台,我们则会接触到 API Key、余额、用量等设置;通过 API 调用模型时,通常按照实际用量计费(此处不考虑订阅方案)。对于文本大模型,一种常见的标价方式就是以每百万 token 为单位,例如 DeepSeek1、Kimi2 和智谱3等平台。这也让越来越多的人开始接触 token 这一概念,而很多人仍直接沿用它的英文名称——token。
今年 3 月 25 日,全国科学技术名词审定委员会发布公告称优先推荐「token」的标准中文名为「词元」。4人民日报等媒体随后以「Token 中文名定了」等标题报道此事。5该译名之后还将在常态化审定中结合社会推广应用情况最终确认。4「元」指基本单元。在语言模型中,token 是文本经过切分或字节级编码后得到的最小离散单元6,它可能对应一个完整的词、词的一部分、单个字符、空格或标点等,甚至一个汉字、一个 emoji 也可能被编码为多个 token(具体怎样切分,则取决于模型及其 tokenizer)。换句话说,token 是模型定义的计算单位,并不等同于自然语言中本来就存在的「词」。你可以在 OpenAI Platform 的 Tokenizer 工具里玩一玩,观察一段文本如何变成一个个 token。

因此,「token」与「词」挂钩,可能会产生误解。
8 月 5 日,人民网发文《人民锐评:用「Token」还是「词元」,事关科技话语权》7,认为人工智能浪潮下,大量外来英文名词「仅作为单纯符号存在」「不具备汉语形音义统一的特质」「无法望文知义」「缺乏文化底蕴」「挤压汉语的表意空间」「抬高了大众理解前沿科技的门槛」「加剧数字鸿沟」「逐步侵蚀汉语体系的完整性与传承性」。这篇文章在网络上引发了一些争议。8
不久后,8 月 7 日,共青团中央发文《你习惯说「Token」,还是更中意「词元」?》9,文中谈到「语言的交流是很常见的」「语言从来不是封闭的系统,而是在交流碰撞中不断丰富的活水」,认为「字母词」的涌入不仅不会损伤汉语的纯洁性,反而会因为汉语的消化力而再发展。这与本文观点类似。文中还举了「站 C 位」的例子,就很形象。「C」是英文「中心」(centre/center)的首字母。10但「站 C 位」已经高度汉语化了,很多人在实际使用时,甚至未必会特别意识到其中的 C 来自英语。它虽然仍以拉丁字母保留着明显的外来形式,却已经自然进入汉语的语法和语用系统。这也说明,外来的词语和语言成分可以在长期使用中逐渐进入汉语的构词、句法和语用系统,被进一步汉语化。你不需要发文推广,语言自己会做这件事。
这里还需要厘清另一个问题:我们讨论的「词元」,只是人工智能领域 token 的译名,而不是英语单词 token 在所有语境下的统一中文译名。「Token」本身是一个多义词:在大语言模型中可以译作「词元」,在身份认证中通常译作「令牌」,在区块链及数字权益语境中又常见「代币」等译法。不同译名恰恰承担了区分不同概念的作用;如果仅仅因为英文原词相同,就把不同领域的 token 一概称为「词元」,反而会抹去中文原本可以通过不同译名建立的语义区分。
这种情况并非假想。《国家安全部发布「词元」安全警示:谨防「囤词元能暴富」等骗局》11一文中,就出现了不同义项的 token 被统一称为「词元」的现象。例如,文中在讨论 XSS、公共 Wi-Fi 嗅探等攻击时,将可能被窃取并用于盗用用户身份、登录账号的身份认证 token 称为了「词元」,但它实际上属于身份认证领域的安全令牌,而非大模型处理信息时所消耗的 token。文章同时又讨论了 AI 场景中的 token 以及区块链中的通证,三个概念因此被同一个「词元」包裹在了一起。
下图为该网页截图。黄色标注部分为「令牌」义,绿色标注部分为大模型「词元」义。

本文绝非意在反对中文译名,而是反对把某个专业领域的规范译名进一步变成对所有使用者的语言要求。一个好的规范译名当然可以由专业机构提出;但它能否进一步成为大众通用的叫法,还要接受真实使用的检验。
网上也出现过一些认真或玩梗式的替代叫法,有些甚至比「词元」更容易产生问题:
- 话费:和 AI 聊天需要花钱,以 token 计费所以叫「话费」。—— 除了聊天,编程智能体以及图像、音频等多模态系统同样可能涉及 token,「话费」无法精准表达。使用什么模型,消耗的 token 数也不同,使用不同模型产生的 token 数量和单价也可能不同,各大 API 开放平台通常显示的是货币余额,而非所谓「话费」;调用产生 token 用量后,平台再按相应单价折算费用并从余额中扣除。
- 语素:有人可能会认为 token 是语言处理中的基本单位,因此想到用「素」来表示;「元素」「像素」等词中的「素」也有基本成分的意味。——但语言学中已有现成的「语素」,指最小的音义结合体,用它指 token 反而容易与既有术语混淆。

与之相对的,表示光源总共发出了多少可见光所用的「流明」(Lumen)就是非常巧妙的翻译:「流」恰好呼应了光通量中「流」的意象,「明」天然让人想到光亮、明亮;同时读音又与 lumen 有一定对应。即使你不知道流明是什么,也大概知道它可能和光有关。还有基因(gene)、幽默(humor),都是非常好的翻译。这种音、义和汉语构词习惯彼此呼应的译名,读来颇有沁人心脾之感,也更容易自然地被语言共同体接受。
目前在业内交流中,直接使用「token」仍十分常见,在它本身并未造成明显表意障碍的情况下,我认为没有必要要求日常交流统一改用某个中文译名。举语言学的例子,目前学术界主流观点认为语言学是描述性(descriptive)的,而非规定性(prescriptive)的;也就是说,现代语言学通常以「描述实际存在的语言事实」为主要任务,而不是以「规定人们应怎样说」为主要任务。当然,这并不意味着专业术语不需要规范;术语标准化本身有协调专业交流的价值。它提醒我们的只是:真实使用同样是一种不可忽视的语言事实。在实际语言中,规范名称也并不总能取代已经形成的习惯用法。比如,「Internet」早期曾音译为「因特网」,后来「互联网」逐渐得到广泛使用1213。国家标准至今仍有《计算机用鼠标器通用规范》14,而现实使用中「鼠标」早已十分常见。查资料时我还有个有趣的发现:一份政府采购文件15里,品目名称写的是「鼠标器」,采购标的却直接写「鼠标」,颇有一种语言「活化石」的感觉。这些例子至少说明,规范机构可以决定专业语境中推荐使用什么名称,却不能单方面决定一个名称最终能否进入大众语言。
当然,「自上而下」的定名并非注定失败。「激光」16就是一个著名的成功案例。一个规范译名只要准确、简洁,又得到专业共同体与社会使用者的共同接受,同样完全可以自然扎根。问题因此不在于「谁有没有资格命名」,而在于命名之后,还要不要接受真实语言使用的检验。
科技话语权的根基首先在原创能力,而不是命名本身。用中文写出前沿论文、做出开源项目、让中文术语因为技术成果本身为世界所用,这才是话语权。好的中文术语能够降低传播和教育成本,也是科技基础设施的一部分;但如果没有原创成果作为支撑,只是把一个已有概念换个中文叫法,就很难说因此获得了这个概念的话语权。这就像把暗恋对象的备注从「暗恋对象」改成「对象」——备注变了,关系并没有因此发生变化。
说到底,专业机构当然有权为专业概念制定规范名称。在法律、医学、安全、计量等需要精确协作的领域,这种标准化甚至不可或缺;当一个称谓本身会制造污名和现实伤害时,由公共机构或专业组织介入、推动称谓规范,也有充分的理由。例如,中国残联明确要求避免「瞎子」「哑巴」「弱智」「疯子」等贬损称谓17;日本精神神经学会也曾将「精神分裂病」改称「统合失调症」18,其中一个明确目的就是减少旧病名造成的污名和误解。
但「有权定名」和「有权决定所有人怎么说」仍然是两回事。规范机构可以决定正式技术语境中的规范名称;一个名称能否从标准文件真正走进日常语言,则最终取决于语言共同体是否觉得它准确、方便、有用。
所以,我并不反对把 token 译作「词元」,也不反对全国科学技术名词审定委员会为它提供规范译名。对于「词元」,不妨让它接受真实使用的检验;它最终会与 token 共存,还是逐渐取代 token,可以交给时间和使用者回答。科技话语权的根基毕竟是原创成果:好的术语能为原创铺路,却无法替代原创本身。
■
※ AI 声明 在创作本文时,我与 OpenClaw (DeepSeek V4 Flash)、ChatGPT 网页端 (GPT-5.6 Sol high)、Kimi 网页端(Kimi K3)协作,其协助我理解和确定概念、辩驳观点、搜索资料和来源、修正语法。我确认所有由 AI 生成或共同创建的内容都经过了彻底的审阅和评估。最终产出物准确反映了我自己的理解、专业知识和意图。尽管 AI 辅助在整个过程中发挥了重要作用,但我对内容、其准确性及其呈现方式承担全部责任。本披露是出于透明的精神,并承认 AI 在创作过程中的作用。
引用资料与脚注
-
↩《模型 & 价格》DeepSeek API 开放平台 https://api-docs.deepseek.com/zh-cn/quick_start/pricing/
-
↩《旗舰模型 Kimi K3 定价》Kimi 开放平台 https://platform.kimi.com/docs/pricing/chat-k3
-
↩《产品定价》智谱 https://bigmodel.cn/pricing
-
↩↩2《全国科学技术名词审定委员会关于发布试用人工智能领域名词 token 中文名"词元"的公告》全国科学技术名词审定委员会 2026-03-25 https://www.cnterm.cn/news/tzgg/202603/t20260325_827999.html
-
↩《人民日报 | "Token"中文名定了:词元》国家数据局 2026-03-25 https://www.nda.gov.cn/sjj/swdt/mtsy/0325/20260325113219152129329_pc.html
-
↩《【中国科学报】专家解读 token 中文名为何定为"词元"》中国科学报 2026-03-30 https://www.cas.cn/cm/202603/t20260330_5105382.shtml
-
↩《人民锐评:用"Token"还是"词元",事关科技话语权》人民网 2026-08-05 https://opinion.people.com.cn/n1/2026/0805/c436867-40774551.html
-
↩《人民网:用"Token"还是"词元",事关科技话语权【OO 锐评】》哔哩哔哩 @沉默的羔丸voov 2026-08-08 https://www.bilibili.com/video/BV1rpu36bEkY/
-
↩《你习惯说"Token",还是更中意"词元"?| 青听》共青团中央 2026-08-07 https://mp.weixin.qq.com/s/6ZDF1WfZSv4H2igSll_Djw
-
↩《"C 位"的前世今生》光明日报 2019-08-10 https://edu.people.com.cn/n1/2019/0810/c1053-31286941.html
-
↩《国家安全部发布"词元"安全警示:谨防"囤词元能暴富"等骗局》央视网 2026-04-07 https://news.cctv.com/2026/04/07/ARTITEuQKNzYUMSVU4r1T6JP260407.shtml
-
↩《光明日报:为科技强国建设增添助力》全国科学技术名词审定委员会 2023-05-29 https://www.cnterm.cn/xwdt/mtgz/202305/t20230529_759550.html
-
↩「因特网」在部分正式技术名称中至今仍有使用:《工业和信息化部关于进一步规范因特网数据中心业务和因特网接入服务业务市场准入工作的通告》中华人民共和国工业和信息化部 2022-11-16 https://wap.miit.gov.cn/jgsj/xgj/wjfb/art/2022/art_731e6c6e6c674ea4b8c55f4f68a9420e.html
-
↩GB/T 26245-2010 计算机用鼠标器通用规范
-
↩《中共陕西省委党校(陕西行政学院)2025 年信息化设备采购项目竞争性谈判公告》陕西省财政厅政府采购管理处 2025-12-19 https://www.ccgp-shaanxi.gov.cn/freecms/site/shaanxi/ggxx/info/2025/8a69c0229b320c95019b35a51a5f7ae9.html?noticeId=25265fc5-dcc6-11f0-8063-08c0eb20c666¬iceType=001013
-
↩《中国科学院老科学技术工作者协会简报 2025 年第十三期(总第 1196 期)》2025-02-24 https://lkx.cas.cn/xwzx/202503/t20250304_5048647.html
-
↩《中国残联:关于在宣传报道中规范残疾人及残疾人工作有关称谓的通知》中国编辑出版人才网 2022-03-07 http://www.chuban.org.cn/h-nd-1419.html
-
↩《はじめに: 呼称変更の経緯》公益社団法人 日本精神神経学会 2015-01-28 https://www.jspn.or.jp/modules/advocacy/index.php?content_id=58
