海光信息王楠:双芯协同锚定词元经营 开放生态打通算网价值落地最后一公里
3 小时前 / 阅读约8分钟
来源:集微网
海光信息在中国联通合作伙伴大会上首发“面向词元经营的双芯加速解决方案”,依托CPU与DCU双芯协同架构,为运营商词元商业化提供全栈式算力支撑,并从四个维度推出全面开放能力。

算网融合的纵深推进,正在改写运营商的商业账本。当行业主线从“卖连接”切换到“经营词元(Token)”,一本全新的经营账正摆在运营商面前:词元如何高效生产、如何动态调度、如何精准计量、如何商业变现,以及每一个环节背后的成本如何精细化核算。这也意味着,支撑算力网络的底层底座,必须同步完成从 “卖硬件算力” 到 “算经营账” 的角色跃迁。

9月9日,以“向智同行,连接算力新生态”为主题的2026中国联通合作伙伴大会在上海世博中心启幕。作为国产算力核心供给方,海光信息在大会上正式首发“面向词元(Token)经营的双芯加速解决方案”,依托CPU与DCU双芯协同架构及开放互连体系,将算力组网、大模型训练推理、智能体Agent调度运营纳入统一算力框架,为运营商词元商业化提供从芯片到应用的全栈式算力支撑。

大会期间,海光信息技术支持与优化中心通信行业方案部总经理王楠接受专访,围绕运营商词元经营的现实痛点、双芯协同的底层逻辑、生态落地的关键路径等行业关注的核心问题,深度拆解了这套方案的技术价值与产业意义。

从卖算力到算力经营,双芯贯通词元全价值闭环

算网融合向纵深推进之下,词元经营正成为运营商掘金AI时代的核心抓手。但从词元生产、调度到计量、变现,全链路始终面临算力调度效率不高、成本难以精细化核算、商业闭环难以跑通等共性难题。

在王楠看来,国产算力产业已经走过了单纯比拼硬件参数的阶段,芯片厂商必须深度绑定运营商的业务经营需求。“现在衡量芯片的竞争力,早就不是只看单纯的芯片算力,而是要看综合吞吐性能与整体使用成本,最终看Token成本。”王楠直言,这要求芯片厂商必须下沉到应用场景,从驱动、算子、框架、模型到应用做全层级深度优化。“只有把单位Token成本降下来,运营商的投资才可能形成正向循环。”

据介绍,海光双芯方案精准覆盖词元“生产—调度—计量—成本核算—应用变现—复购扩容”的完整价值周期。海光CPU作为Agent业务的系统枢纽,发挥拓扑感知优势,负责内存分配、NUMA节点对齐、任务统筹编排与记忆管理等复杂调度工作;海光DCU作为词元生成的并行计算引擎,支撑P/D分离优化、批量解码、KV缓存加速、预处理及长序列高效处理等算力密集型任务。二者通过高速数据协同与内存协同机制,实现业务流量的智能分流与动态调度。

“CPU做它擅长的调度与编排,DCU做它擅长的并行加速,双芯协同才能真正提升词元生产的全链路效率。”王楠表示,这种分工既匹配了智能体多任务调度的复杂场景,也适配了大模型高并发推理需求,最终帮助运营商构建可持续的词元经营商业闭环。

四维开放破局“最后一公里”,把适配做在业务前面

词元经营规模化落地的最大堵点,往往不在硬件本身,而在生态适配的“最后一公里”。运营商业务场景差异化大、AI模型迭代速度快、异构算力栈适配难,都制约着方案的落地效率。

对此,海光方案从算力、互连、安全、软件栈四个维度推出全面开放能力。在王楠看来,生态开放的核心是降低用户的使用门槛,而真正的落地“最后一公里”要解决两个核心问题,一是兼容性与易用性,让用户用起来方便;二是性能与效率,让用户用起来划算。

为了打通这一公里,海光组建了专门的技术优化团队,在应用开发早期就深度介入,从驱动层、算子层、框架层、模型层到应用层做全栈调优。比如针对P/D分离架构、算子卸载等特性,海光会提前与应用厂商联合调试,而非等产品正式发布后再启动适配。

“像智谱、通义千问这些主流大模型,在正式发布之前我们就已经完成了前置适配与优化。”王楠透露,这样一来,基于这些大模型开发的行业应用,发布后可以直接在海光算力平台上落地,大幅缩短了业务上线周期。

互连层面,以海光自研HSL高速互连协议为核心,已面向产业链全栈开放,支持从单机多卡到万卡以上大规模异构互联,突破传统带宽瓶颈,大幅提升芯片间数据流转效率。软件栈层面,通过全栈开发工具链适配百余种主流AI框架,降低模型迁移和应用开发门槛。

芯片级内生安全,筑牢资源经营的核心底线

随着AI业务逐步进入运营商核心生产系统,数据安全与模型安全成为词元经营不可逾越的底线。尤其对于多租户、高并发的词元交易场景,全链路可信防护是规模化推广的前提。

“不管是大模型应用还是智能体调度,AI安全都是运营商做资源经济最核心的底线。”王楠强调,海光安全能力的最大特点是内置在芯片硬件层面,CPU内嵌安全协处理器,无需额外外挂安全芯片即可实现硬件级安全防护,支持国密SM2/SM3/SM4加密、可信计算和虚拟机隔离。

据介绍,这套芯片级安全能力覆盖三重防护体系,一是国密算法加密,支持国密SM系列标准,实现数据全链路加密;二是全生命周期可信验证,从芯片上电、运营运行到关机断电,每一个环节都进行完整性校验;三是硬件级虚拟机隔离,面向多租户场景实现物理资源共享、逻辑数据隔离,确保不同用户数据互不可见且全程加密存储。

“软件加密往往会带来明显的性能损失,而硬件级安全可以在不牺牲算力效率的前提下,为词元经营构筑全链路可信防护。”王楠表示,这也是运营商客户最为看重的能力之一。

从通信到千行百业,开放生态加速场景落地

技术方案的价值最终要通过商业落地来验证。借助中国联通的行业触点与渠道网络,海光的双芯方案已经在多个垂直行业实现商用突破。

王楠举例说,海光已与山西联通联合打造“全域AI矿山智能感知一体机”,部署在矿区边缘现场,通过视频智能分析实时识别人员违规操作与危险行为,同时结合任务编排能力实现矿山作业的智能化调度。“山西矿山场景多、安全要求高,这套方案把算力下沉到边缘,既满足了实时性要求,也降低了整体部署成本。”

在上海本地,金融、教育等重点行业的适配也在加速推进。王楠举例,针对金融行业OCR等高频场景,海光通过算子融合优化降低通信带宽占用,大幅提升系统响应速度;在同济大学等高校,海光通过算力虚拟化技术,将单张加速卡切分为多个虚拟算力单元,满足更多师生的科研需求,显著提升了资源利用率。

这背后是“光合生态”的体系化支撑。王楠介绍,目前光合生态已有超过6000家合作伙伴,覆盖整机、基础软件、行业应用等全产业链环节,上万个应用完成了前置适配验证。“我们不绑定单一整机厂商,所有厂商都可以基于海光芯片开发产品。”在他看来,开放的生态才是国产算力规模化落地的根本基础。

结语

从算力硬件供应商到经营场景支撑者,海光的角色转变,正是国产算力产业从“建算力”向“用算力”升级的一个缩影。随着运营商算网建设进入深度运营阶段,词元经营的商业化探索才刚刚拉开序幕。

“从生产、调度到计量计费,再到复购扩容,运营商要的不是一堆孤立算力,而是一套能持续经营的底座。”王楠表示,未来海光将继续依托光合生态,联合上下游伙伴深化产品适配与联合创新,推动国产CPU、DCU与各类异构算力的统一调度与协同运行,支持行业用户结合业务发展节奏实现分阶段平滑扩容。“让国产算力以更高质量、更高效率赋能实体经济数字化转型,这是我们长期坚持的方向。”