华为联合上海交通大学、西安交通大学、厦门大学,在“2025AI容器应用落地与发展论坛”上正式发布并开源了AI容器技术Flex:ai。该技术旨在实现算力资源的精细化管理与智能调度,推动AI技术的普及应用。华为公司副总裁周跃峰指出,尽管AI技术发展迅速,但实现其“平民化”仍面临诸多挑战,他以医疗行业为例,说明了当前算力调度存在的粗放问题。华为刘淼进一步指出,当前AI算力使用存在三大核心痛点:小任务单卡算力过剩、大任务单机算力不足,以及多任务并发调度困难。针对这些问题,三所高校分别从不同维度进行了技术攻关:上海交通大学戚正伟教授介绍了XPU资源池化框架,实现了空间共享与资源隔离;厦门大学与上海交通大学张一鸣教授共同研发了跨节点拉远虚拟化技术,有效聚合了空闲XPU算力;西安交通大学张兴军教授则研发了Hi Scheduler调度器,实现了细粒度的算力调度。华为已将Flex:ai全栈技术开源,并计划联合高校持续迭代优化。华为张弓还指出,企业在部署AI推理时仍面临诸多矛盾,特别是跨节点迁移与大规模集群调度方面,仍是亟待解决的难点。
