中国移动天津公司携手华为实现AI推理加速方案全国首商用,树立运营商智算新标杆
4 小时前 / 阅读约3分钟
来源:C114
天津移动宣布数据存储AI推理加速解决方案正式商用,采用华为高性能存储及算法,实现性能倍增、成本降低,支撑Token套餐及校园大赛,推动“算力经营”向“Token经营”转型。

中国移动通信集团天津有限公司(以下简称“天津移动”)宣布,数据存储AI推理加速解决方案在天津移动正式商用上线,成为全国首个在现网规模商用的运营商AI推理加速智算集群。

该项AI推理加速方案采用华为OceanStor A800高性能AI存储及AI推理加速算法,2026年8月在天津移动空港智算中心昇腾910C算力集群完成部署验证,既满足了天津移动内部自用业务AI能力提升,又对外用于Token和算力租赁服务。其中,对天津移动近期发布的Token套餐,以及在9月策划的“天津移动Token校园大赛”,都起到了关键的支撑作用,实现了打造Token工厂品牌,为公众及高校学生提供Token服务,标志着天津移动在“算力经营”向“Token经营”转型的道路上迈出了实质性的一步。

当前,业界主流模型正加速向MoE(Mixture of Experts,混合专家)结构和长上下文窗口演进,其推理产生的KV Cache数据量呈现出“爆炸式增长”,KV Cache容量瓶颈已成为制约推理效率与成本的核心痛点。天津移动联合华为公司通过深化“算网存”协同创新,以高性能算力为引擎,以全光运力为纽带,以AI高性能存储为基座,成功构建了基于UCM(Unified Cache Manager,推理记忆数据管理)技术的AI推理加速底座。

现网商用数据则显示,该方案在真实业务场景中表现卓越:

·性能倍增:在实际话务模型下,支撑GLM-5.1、Kimi-K2.6、DeepSeekV4、Qwen系列等主流大模型时,长序列(64K,128K等)场景下现网集群吞吐率单卡提升1.1~3倍,首Token时延(TTFT)降低30~40%,支撑并发会话数提升,显著优化了用户交互体验。

·成本降低:通过UCM技术实现KV Cache的高效复用,Token推理成本降低30%,使得“Token低成本”成为可能,真正为运营商Token经营构筑核心竞争力。

该方案在内部Agent开发和AI coding场景中亦显著提升了工作效率,月均Token调用量已达500万次,并正在为秋季开学的高校校园Token算力大赛助力。天津移动人工智能产研院负责人表示:“此次AI推理加速方案正式商用,是双方协同创新推进的结果。未来我们将深化技术攻关,持续提升AI推理性能,夯实AI算力底座。”

天津移动规划技术部总经理杨桐指出:“从‘技术验证’到‘业务商用’,天津移动走在了行业前列。此次将AI推理加速方案直接应用于算力大赛,不仅是对技术稳定性的极致考验,更是我们对‘算力普惠’承诺的实践。通过AI存储带来的成本优势,我们让青年队伍能够毫无顾虑地释放创意,让算力像水电一样无处不在。未来,我们将基于此商用底座,进一步拓展ToB政企市场,将‘高性价比、低时延’的AI服务推向各行各业。”