写文案、查资料、做视频、写代码……AI用得越多,消耗的词元(Token)就越多。词元不仅是AI理解信息的最小单元,也成了AI服务计费的标尺。但北京青年报记者发现,同一段话在不同模型里切出的词元数可能差一半,不同渠道的计价方式也五花八门,用户很难直接判断性价比。业内人士建议,统一的词元计量标准和账单披露规范亟待建立,让用户像看家里电表一样清楚知道“钱花在哪了”。

同一文本,不同模型切出的词元数可能相差50%

打开网易新闻 查看精彩图片

随着大模型应用爆发,我国词元调用量快速攀升。国家数据局数据显示,2024年初日均词元调用量仅为1000亿次,到2026年6月已突破500万亿。

词元是大模型处理信息的最小单元。给AI一段文字,模型会先把文字切分成一个个词元来理解含义、生成回答。一个常见英文单词可能对应1到2个词元,一个汉字可能对应1到3个词元,标点符号通常也会被单独编码。行业内普遍以每百万个词元为计价单位。

但同一段话,在不同模型里切出的词元数量并不一样。比如中文“人工智能”,有的模型切成1个词元,有的切成4个——有的按字切,一个字算一个;有的按词切,一个词算一个。代码、数字、符号的切法也不统一。

这种差异直接影响最终计费。假设一段中文,模型A切成100个词元,模型B切成150个词元,如果单价相同,模型B就贵50%;就算模型B单价便宜,词元多了最终可能还是更贵。所以看AI价格不能只看“每百万词元多少钱”,还得算“处理同一段文本实际花多少钱”。

此外,大模型厂商的词元价格还分输入和输出——用户发的提示词、上传的文档按输入算,模型生成的回答按输出算,两边都受切分规则影响。

厂商下场卖套餐,月付从118元到1078元不等

对于有开发需求的个人和企业用户,普遍采用付费模式。行业数据显示,目前AI短剧与视频生成的词元消耗占比已超过50%,代码编程也是主要消耗场景之一。

拥有核心定价权的大模型厂商也自己下场“卖词元”。以智谱在电商平台上架的词元套餐为例,支持按月、季、年三种周期购买,分为个人版Lite、Pro、Max以及团队版标准席位等多个档位,月付价格从118元到1078元不等,季付8折、年付7折。

智谱工作人员介绍,套餐制按月、季、年购买,周期内没用完到期失效,词元换算成积分扣除,同时设有每5小时和每周额度上限。“把词元换算成积分会更直观,如果用于编程,套餐性价比高一些。”此外,官网上还支持充值方式,余额没有时间限制。

运营商搭售:5.9元买400万词元还送流量

打开网易新闻 查看精彩图片

除了大模型厂商,三大运营商也推出了词元算力套餐,有的绑定话费、搭售流量包。中国电信词元套餐最低月费9.9元起,每月1000万词元。中国移动推出算力豆套餐,价格从5.9元至119.9元不等,算力豆可兑换词元用于智能体应用。

北青报记者在中国移动APP看到,其算力豆套餐包含月包和次包,除了算力豆还搭售流量包。5.9元次包含400算力豆和1G通用流量,按1算力豆约1万个词元算,400算力豆就是400万词元;119.9元月包含12000算力豆和5G通用流量。

有用户认为,像充话费买流量一样买AI服务确实方便,但输入、输出、缓存未命中都是单独计费的,买了套餐后模型是否减配,用户也无法预知,实际使用效果存在不确定性。

同一个模型部署在不同平台上,价格和性能差异也很大。比如智谱GLM5.2曾在OpenRouter平台上有22家服务商,价格最高相差超过8倍。背后核心原因在于各家服务商的调优能力、缓存调度能力、上下文处理能力不同。

专家:统一计量标准和账单规范亟待建立

北京数据集团旗下智能院集团副总经理朱璐璐认为,当前不同模型的分词算法差异导致同一文本词元数不同,给跨平台比较和定价带来困难。为使词元真正成为AI服务的通用度量衡,统一的词元计量标准和编码规范亟待建立。随着词元经济规模扩大,词元的质量分级、安全审计、跨平台流通互认等标准也需逐步建立。

趋境科技副总裁郑环环在接受北青报记者采访时表示,当前词元计费存在“黑箱”——模型是否减配、不同平台分词差异,用户都无法预知和察觉。她建议行业尽快建立标准化的账单披露规范,让用户知道“钱花在哪了”,就像家庭安装电表一样。

在郑环环看来,随着文本、图像、音频、视频等多模态词元需求爆发,不同模态的信息密度和结构差异巨大,计量与定价的复杂度进一步加剧。如何为不同行业的数据建立统一的质量、确权、计量与定价标准,是“词元”能否从单一服务计费单元升级为通用“货币”的基础前提。

北京已开始探索。最近发布的“词元经济十条”提出,北京将打造词元分发平台,为开发者提供统一接口、模型聚合、词元计量与结算服务。

文/北京青年报记者 宋霞

编辑/周超