中国信通院:Token工厂成为智算基础设施新形态,产业竞争转向“每瓦Token产出”
5 小时前 / 阅读约9分钟
来源:C114
中国信通院报告指出,AI推理算力首超训练算力,Token成衡量AI产业新标尺。智算基础设施正从“算力工厂”向“Token工厂”转型,涉及技术、商业模式、政策导向等多方面变革。

C114讯 近日,中国信息通信研究院发布《面向词元(Token)服务的智算基础设施发展研究报告(2026年)》。报告指出,人工智能正加速从技术突破迈向规模化应用,推理算力首次超越训练算力成为需求主体,Token(词元)取代FLOPS、GPU卡数成为衡量AI产业价值的新标尺;智算基础设施从“算力工厂”到“Token工厂”并非概念更迭,而是计算范式、技术栈、商业模式的系统性重构。

从“算力工厂”到“Token工厂”:价值标尺全面切换

报告显示,智算基础设施的价值标尺正从峰值算力切换为Token产出能力。据TrendForce数据,2026年北美五大云端服务供应商的总AI训练算力将年增56%以上,而AI推理算力将年增约122%,推理算力增速是训练的两倍以上。产业竞争焦点正从“拥有多少算力”转向“产生多少Token”。

报告将Token工厂定义为:以Token为统一计量单元,面向AI推理服务需求,将电力与算力高效转化为标准化Token输出,并按Token消耗量进行计费与交付的智算基础设施新形态。目前,Token工厂正在全国加速落地。

报告对比指出,Token工厂的核心效益指标已从总算力规模、机柜上架率,转向每瓦Token产出、单位Token成本与服务SLA;计费模式从按卡时、机柜租赁,转向按Token消耗量计费、结果化交付;算力服务商业模式正经历从“卖硬件”到“卖服务”再到“卖价值”的三级跃迁,从裸金属GPU租赁、算力规模租赁、GPU时租,演进到Token即服务(TaaS)、智能体即服务(AaaS)、结果即服务(RaaS)。

2026年5月,中国电信、中国移动、中国联通相继推出Token套餐产品,Token首次被纳入通信资费体系。

政策导向:从“重建设”转向“以Token效益定优劣”

报告认为,智算基础设施政策体系正从“重建设、轻运营”全面转向“以用促建、以Token效益定优劣”。“人工智能+”行动从顶层设计走向全面实施,“算电协同”首次写入《政府工作报告》并被纳入“十五五”规划纲要,算力网被纳入国家“六张网”重点基础设施。

国家层面,工信部启动“1+M+N”国家算力互联互通节点体系建设,公布首批17个区域节点建设名单。全国一体化算力网监测调度平台已有20余家算力调度主体入驻,以63项指标绘制全国算力资源“动态地图”。广州上线全国首个基于Token级调度的城市综合算力运行服务平台,江苏上线全国首个省市一体化算力调度监测平台。

地方政策试点突出运营服务效能。北京经济技术开发区发布“词元十条”,对开展推理效能跃升的企业按算力租赁费用的30%给予最高2000万元资金支持;四川省发改委明确支持建设词元工厂等算力公共服务设施,按项目核定总投资的15%给予支持。上海将算力券、模型券(Token券)、语料券申报与全市算力资源统一接入、统一调度相衔接;广州海珠区“词元八条”覆盖词元“生产—流通—消费—增值”主要环节;深圳宝安区引导算力服务商从“硬件设备交付”向“模型即服务”升级。工信部还发布城城“毫秒用算”专项行动通知,首批在31个省(区、市)的50个地市开展试点。

区域布局:训推分层协同,三级梯度支撑Token服务落地

报告指出,截至2026年7月底,八大枢纽和三个算电协同区已建成智算规模占全国比重超85%。训练任务高度集中、推理任务广泛分布,推动形成“训练枢纽+推理节点+边缘Token端”的分层布局。东部枢纽在现有训练集群基础上叠加部署高密度推理节点,面向本地产业提供低时延Token服务;西部枢纽依托绿电与气候优势,探索向“Token产能基地”转型。各枢纽节点形成差异化路径:京津冀侧重“训练+高价值推理”,长三角侧重训推一体平台化运营,粤港澳大湾区构建“韶关训练+广深推理”协同格局,成渝采用双集群布局,西部四大枢纽侧重低成本Token产能规模化输出。

对于非枢纽区域,报告提出构建“核心城市—重点城市—活力城市”三级梯度的Token服务布局体系。核心城市承担前沿模型研发与高价值Token服务供给;重点城市以行业模型推理与微调Token供给为主;活力城市以边缘Token节点服务本地场景。中国联通在宁波建成日产百亿级Token工厂,上线1个多月已服务上千家企业、10余个园区;广东湛江联合云天励飞落地面向政务的“国模+国芯”人工智能词元工厂。报告同时指出,跨区域Token协同仍面临质量保障机制缺失、成本分摊机制尚未建立、跨域调度规则不完善等挑战。

技术创新:从“峰值算力最大化”转向“每瓦Token产出最大化”

报告强调,面向Token服务,智算基础设施技术重心正从“峰值算力最大化”全面转向“每瓦Token产出最大化”。芯片层面,存储带宽与内存容量取代峰值算力成为首要瓶颈,异构协同成为降低Token生成成本的核心路径。英伟达Rubin GPU与Groq 3 LPU协同构成GPU+LPU异构推理架构;华为昇腾950采用“一芯双构”策略;寒武纪思元690已实现量产,配备196GB HBM3高带宽内存,完成GLM、DeepSeek、Qwen、Kimi、MiniMax五大国产主流大模型推理适配。

软件层面,连续批处理、KV Cache分页管理、投机解码等技术已在vLLM、SGLang、TensorRT-LLM等主流推理引擎中广泛落地。2026年,SGLang为月之暗面Kimi K3提供发布日推理支持,将单卡解码速度从44提升至113 token/s,叠加DSpark投机解码后进一步达到423 token/s。

集群层面,超节点与训推一体重构部署形态。2026年被业界定义为“国产超节点元年”。华为Atlas950 SuperPoD昇腾超节点单柜64卡单元可横向扩展至8192卡,支撑50万卡国产智算集群;中科曙光展出国内首套十万卡全栈自主“登峰8000”AI超集群;中兴通讯智算超节点方案单机柜支持128个GPU,可Scale-up至1.6万卡。训推一体架构通过统一调度,将资源利用率从行业普遍的30%—40%提升至80%以上。

互联与调度层面,Token级调度系统成为跨集群协同的“大脑”。HAMi商业化版本Rise已在央国企场景中实现4倍运行效率提升。中国联通完成AI大模型300公里分布式协同训练验证,跨域等效算力达单集群95%以上;中国移动完成800G以太网智算协同训练现网试验,等效算力效率达98%以上;中国电信联合无问芯穹完成国内首例超4000公里大模型跨域混训,四集群协同性能提升41%。

产业生态:多元主体协同推动价值交付

报告显示,产业主体格局正深度重构。央国企从算力投资方向Token服务运营商转型。中国电信2026年4月启动国内首个以“Token工厂”命名的174.38亿元集采项目;中国移动发布Token运营生态体系,宣布未来3至5年投入百亿级Token生态资源、建设千亿级算力基础设施;贵州移动“词元工厂”日调用量已突破百亿;云南移动通过异构算力统筹与潮汐智能调度,将集群算力利用率从不足30%提升至90%以上。传统IDC服务商加速向Token工厂转型,新兴Token服务商与CDN厂商入局。网宿科技在常州落地首个城市级绿色词元工厂,项目建成后可年产Token 60万亿个。

生态协作方面,算电协同、分布式协同、算模协同、政产学研用协同等模式共同推动智算基础设施从资源供给走向价值交付。商汤大装置发布算电协同Agent,已在商汤临港AIDC落地,实现单位电力成本Token产出提升80%;常州绿色词元工厂由七方合作,构建覆盖“绿电供给—算力建设—技术平台—运营服务”的全链条协同格局;中国移动联合腾讯、阿里、华为、中兴、科大讯飞等生态伙伴共同构建Token服务生态。

展望:推动从“算力工厂”向“Token工厂”高质量转型

报告认为,当前面向Token服务的智算基础设施正处于范式重构的关键窗口期,但产业生态仍不成熟,规划建设与服务效能之间仍存在结构性不匹配。报告建议:完善政策引导,强化规划协同与服务效能导向;优化区域布局,推动算力资源分级配置与跨域协同;夯实技术创新,强化面向Token服务的软硬件基础;培育产业生态,构建多元主体协同的Token服务体系。通过系统性政策供给、区域布局优化、关键技术攻坚与产业生态升级,推动智算基础设施从“算力工厂”向“Token工厂”高质量转型。