最近,在全国一些城市,花9.9元可以买到1000万Token。
这是中国电信在今年推出的一档月度套餐,主打尝鲜体验。用户购买后,可以在一个账户里调用中国电信星辰大模型、DeepSeek、GLM等多个主流大模型,用于写文案、做总结和处理日常办公任务。
1000万Token是什么概念?假设一次普通问答的输入和输出合计消耗约2000个Token,这笔额度可以完成约5000次问答。
与此同时,更多地方国资也在入局这门生意。嘉兴城投运营起长三角Token运营中心;温州数据集团旗下公司上线“词元天下”,向企业提供普惠包、按需套餐和专属服务;北京国资公司建设了Token工厂;广州国资平台开出模型超市。

AI算力慢慢走到普通用户面前,且开始拥有明确的价格、额度和购买渠道。
众多资本也在快速进入市场。2026年9月20日,具有“中国最大Token工厂”之称的硅基流动宣布完成B+轮二期和C轮融资,年内累计融资近29亿元。新一轮投资名单里,中国互联网投资基金、国新基金、中国移动链长基金等国家级基金和央企资本集中出现,多家地方国资、产业资本同时下注。
短短几个月,模型公司、AI创业公司、运营商和地方国资站到了同一个市场。它们控制的资源各不相同,出售服务时却使用了同一个单位:Token。一个原本藏在大模型API账单里的技术单位,走进了资本、城市和企业的经营体系。
过去三年,AI行业相信“算力即权力”,他们投入大量资金购买芯片、建设数据中心、训练大模型。现在,当AI进入实际应用,这条产业链上的各方,开始关心这些投入最终能生产多少Token,又能够以多低的成本生成Token。

硅基流动融资、运营商销售套餐、城投建设运营中心,共同指向同一个变化:AI算力正在从一套需要自行建设的技术系统,变成一项可以持续采购的服务。
而这热闹的背后究竟是一门怎样的生意?
Token被摆上货架
大模型在处理一段文字前,会先将其拆分成更小的单元。一个汉字、一个英文单词或者一组词语,都可能被编码成Token。用户输入问题,模型理解并生成答案,皆会产生Token消耗。目前,国家数据局已正式将其中文名称定为“词元”。
Token首先是AI大模型处理信息的最小计量单位。大模型商业化以后,Token成为API最常见的计费单位。平台按照输入和输出量收费,企业预先充值,调用后扣费。面向个人销售时,这套计价方法又被包装成积分、月卡和套餐。
如今,人们可以在天猫旗舰店直接购买智谱的Token。
9月2日,智谱在天猫成立官方旗舰店。用户打开淘宝,搜索“智谱旗舰店”,便能看到四款GLM Coding Plan:个人版Lite、Pro、Max,以及团队版标准席位。

选择想要的档位、下单、付款,整个过程与购买视频会员相似。套餐开通后,用户获得模型调用额度,可以在ZCode、Claude Code、Codex等20余款编程工具中调用GLM-5.3,用于生成、调试和重构代码。
严格来说,用户买到的并非一笔可以任意支配和转售的Token。它以Token消耗的积分为基础,用户在额度范围内可自由调用,超出部分则按标准API价格计费。Token由此成为一件可以被明码标价的产品。
但货架上的Token来自不同供应商。
OpenAI、智谱等模型公司销售自有模型的原生API;硅基流动等推理平台购买或组织算力,部署开源模型,再向开发者提供统一接口或本地部署方案;运营商和地方国资则将算力、模型和本地客户集中到区域平台,出售套餐或者行业解决方案。
爱分析研究咨询机构联合创始人兼首席分析师张扬长期关注AI产业链,他对盐财经表示,Token供给大致概括为两条主要路径:模型公司直接提供API,或者第三方使用自己的算力部署开源模型。前者的竞争力来自模型能力,后者比拼算力成本、推理效率和模型接入数量。

高临咨询(Third Bridge)是一家一手调研机构,据盐财经了解,高临咨询将第三方Token平台比作“万能插座”:开发者使用一套API和密钥,便能接入多个模型。平台减少了逐一接入的成本,还可以按照价格、延迟和任务类型选择不同模型。
硅基流动是这类平台的代表。它向个人和开发者提供按量收费的公有云服务,也向企业出售专属实例和本地部署方案。平台从云厂商和算力供应商获得计算资源,将不同模型适配到不同芯片上,再通过请求合并、模型路由和任务调度提高机器使用率。它卖出的不是服务器本身,而是经过部署和优化后可以直接调用的模型能力。
根据高临咨询的专家分析,中间平台的核心价值在于中立性与标准化能力。由于国内各云平台大多自有模型及业务场景,第三方中立度不足,可能令开发者及合作模型厂商均有所顾虑;反之,聚合平台的定位强调中立、客观的第三方性能测评与模型路由。
地方国资则从另一端进入市场。过去,城投主要承接道路、园区和公共设施建设,通过融资、土地开发和政府回款维持运转。房地产下行和土地财政收缩后,传统重资产项目的扩张空间收窄,越来越多城投转向产业投资和资产运营。
今年8月,北京经济技术开发区管理委员会发布了一系列措施推动智能经济产业的发展,对开展相关模型业务的企业,按照租赁算力费用的30%,给予最高2000万元的资金支持,且计划每年发放1亿元数据券,按照年度数据交易金额的10%,给予采购主体最高100万元资金支持。

同年3月,区属城投国企科学城集团运营的广州智能软件谷发布“Token 8条”,面向入驻企业提供多项支持;同年7月17日,科学城集团旗下科学城数科集团正式发布“湾区智城模型超市”,依托自建的“黄埔1号”智算中心,对订阅企业提供为期三个月、每月6亿Token免费调用额度,额度用完后按量计费并执行阶梯优惠,综合降本幅度最高可达约60%。
对于部分地方国资来说,他们已经掌握数据中心、产业园区和本地政企客户,容易将算力资源调整成按Token结算的模型服务。张扬认为,地方国资通常承担出资、建设和算力资产运营,真正的模型部署和推理优化仍由技术公司完成。
高临咨询的专家则表示,运营商与地方国资平台均不是Token的零售主体。前者是算力的储备方与通道方,模型厂商缺卡时会来此调配资源,优势在牌照、客户关系等;后者更接近算力资产的持有与代持方,其采购受政策与预算双重约束。
需求增长,国资下场
事实上,模型公司、推理平台、运营商和地方国资在此时汇合,直接动力来自推理需求的增长。
过去,大模型主要被用来回答问题、总结材料、生成文案,调用由用户主动发起。一次对话结束,计算随之停止。智能体进入编程、客服、营销和研发流程后,会连续拆解任务、读取资料、调用工具并检查结果。用户只下达一次指令,后台可能发生数十次模型调用。
国家数据局披露,中国日均Token调用量从2024年初的1000亿次增至2025年底的100万亿次,2026年3月超过140万亿次,两年涨近1400倍。

《Token经济》一书中提到一道关键的剪刀差,当等效智能成本呈摩尔定律式下降,需求却呈杰文斯悖论式扩张。算法、芯片和工程优化不断压低单位智能成本,但价格越低,越多原本算不过账的场景被打开,Token调用量和总支出反而可能上升。
例如19世纪工业革命时期,当蒸汽机效率提高,按理说煤炭消耗应该更少,但事实是煤炭总消耗反而暴涨。
用户扩大、模型降价、上下文变长以及图像和视频生成都在增加消耗。AI进入持续运行的工作流,也提高了单项任务的Token用量,使模型调用逐渐成为企业需要管理的日常成本。
需求扩大后,产业链的竞争开始转向生产效率。
问题不再只是拥有多少块GPU。一批服务器接入数据中心,只能提供原始计算能力。企业要真正调用模型,还需要完成模型部署、芯片适配、任务调度和API交付等流程。同样的芯片运行不同模型,生成速度和单位Token成本可能明显不同。平台通常要按照白天的调用峰值准备容量,夜间机器闲置,租金和折旧成本却依然存在。

当客户购买的对象从一次性系统变成持续调用,智算中心也开始具有生产系统的特征。“Token工厂”正是这种变化的体现。
联想中国基础设施业务群战略技术总监黄山在一次公开访谈中,将“Token工厂”概括为一种“标准化、有规模、可追溯、可预测、可结账”的智能生产方式。智算中心提供计算资源,Token工厂进一步处理数据、任务调度和工作流交付。这个概念带有厂商的产品视角,但实际对应的产业竞争的新指标却很清晰,即,同样一笔芯片和电力投入,谁能生产更多、更稳定的、成本更低的Token。
硅基流动获得资本青睐,正是因为它试图提高这条生产线的效率。它不训练自己的基础模型,而是适配不同芯片和开源模型,通过推理引擎与算力调度对外提供Token服务。
截至2026年4月底,其平台注册用户超过1000万;截至6月21日,企业客户超过1.3万家,累计支持170多款模型,并适配10余款国内外芯片。2026年4月,平台日均Token吞吐量达到5785亿次,相较于2024年12月的478亿次的日均吞吐量,增长了11倍。

其资本结构也呈现出产业重心的移动。硅基流动早期投资者包括阿里、华为旗下哈勃投资、美团、商汤和壁仞科技,模型、云和芯片企业率先下注。而在这新一轮融资中,国家级基金、运营商和地方国资成为硅基流动重要的参与者。
从智谱的投资路径中也可窥见一二,公开融资信息显示,它先后投资硅基流动、无问芯穹、清程极智等AI Infra企业,覆盖模型服务平台、软硬件协同和推理优化。这些投资显示,智谱或许希望通过投资连接推理基础设施,为下一阶段的Token供应提前铺路。
就全球来看,根据IDC(国际数据公司)在2026年4月发布的报告,2025年全球AI基础设施支出达3 180亿美元,比2024年的1530亿美元多了1倍。
可以得知,Token正在变成一种新型生产要素,而这并不是未来时。
Token经济,从亏损开始
纵观人类商业史和经济变革,一种新计量单位的普及,往往意味着新的交易方式和经济服务正在形成。
蒲式耳统一了粮食交易的数量标准,使买卖双方可以为一批未曾见过的小麦定价;千瓦时把持续流动的电力拆分成可结算的用量,电网调度、工业能耗管理和居民电费由此建立。计量单位让原本难以远距离交易、持续结算的产出进入市场。
Token正在大模型产业中承担类似功能。
但尽管Token吞吐量迅速增长,硅基流动却仍未从这门生意中赚到钱。
招股书显示,硅基流动的收入从2024年的734.6万元增至2025年的5533万元,同比增长653.2%;同期毛利率从39.4%降至负24%,2025年毛损约1330万元,经调整净亏损达到1.87亿元。

亏损主要来自公有云Token服务。2025年,这项业务收入2926万元,毛利率为负119%;本地部署收入2607万元,毛利率达到82.5%。公有云业务按照调用量收费,标准化程度更高,也更接近平台希望形成的规模化生意;本地部署则需要进入客户的数据中心完成安装和适配,交付更繁琐,价格也更高。
这意味着,现阶段,能够反复销售的标准化服务没有覆盖成本,定制化项目反而贡献了主要毛利。
其中,算力是最大的支出。2025年,硅基流动算力资源成本约5963万元,占销售成本的86.9%,已经超过全年收入。为了保证用户随时调用模型,公司需要提前租入算力并预留容量,使用率却只能随客户增长逐步提高。
高临咨询对接的专家认为,从算力侧来讲,通过卖Token来赚取差价的这门生意暂时还很难成立。现阶段不少Token运营平台仍然依靠芯片适配、推理优化、私有化部署等企业项目获得收入。单纯依靠Token调用价差盈利,需要较高的付费用户占比和算力利用率。

对不自持算力的平台而言,“如果是算卖Token赚的钱多还是把这个服务器包月租出去赚的钱多,那肯定是把机器包月租出去赚的钱多”,根因是Token工厂的流量集中在白天、容量按白天峰值封顶,夜间基本空置。
免费Token也在放大亏损。2025年,硅基流动向用户发放代金券,由此产生的推广算力成本达到5421万元,接近全年收入;同期研发开支约2.09亿元,相当于收入的3.78倍。
与此同时,模型公司提供按Token计费的API服务,已经出现另一种结果。
2026年上半年,智谱开放平台及API业务收入达到8.25亿元,占总收入的86.5%,成为其第一大收入来源,相关业务毛利率升至24.6%。智谱过去主要依靠本地化部署获得收入,如今收入重心已经转向按照调用量收费的云端业务。

但智谱同期经调整净亏损仍达到19.64亿元。尽管API服务开始赚钱,仍尚不足以覆盖模型训练、研发和基础设施投入。
两家公司的差异说明,Token经济已经形成市场,但还没有形成稳定的利润模式。
在商业史上,统一计量只是大宗商品市场形成的第一步。
Token具备了大宗商品的部分特征:能够标准计量,可以规模化生产和持续采购,价格也会随供需与生产效率变化。但它还没有大宗商品那样的同质性。不同模型生成的一百万Token,在能力、速度和稳定性上存在差异。同样数量的Token进入不同任务,创造的价值也可能相差数十倍。
用户真正购买的,是Token带来的价值。《Token经济》将其概括为,智力即服务。如今购买智力,我们买的是Token,是任务,是工作流,是结果,乃至不知疲倦的数字员工。智力第一次脱离单个具体的人脑,可以被连续调用、计量和计费。Token正是这套交易结构的计量单位,它计量的是智力服务的产出,
眼下,各方仍在用算力、研发投入和免费额度换取调用规模。只是,价格尚未覆盖整条产业链的成本。未来,若企业需求稳定增长、服务质量逐渐标准化,Token可能进一步获得类似大宗商品的市场属性,而规模化盈利仍是这门经济里关键且尚未完成的重要一步。
文 | 刘舒雨
编辑 | 宝珠
新媒体编辑|辰夕
视觉 | 诺言