国产 AI 开始自我优化国产芯片:GLM-5.3 Flash 两周实现 3.2 倍性能
3 小时前

新一代大模型正转向RSI自我递归升级,智谱公布了最新进展:其近期发布的多模态大模型GLM-5.3 Flash,采用10万块全国产芯片部署,单位Token推理成本较年初大幅下降80%。在GLM-5.3的驱动下,Infra Agent仅用两周时间就助力该模型在国产加速卡上顺利运行,并承载了全部线上流量,端到端吞吐量提升至原来的3.2倍,同时解决了KDA精度漂移等三个关键问题。此外,智谱还透露,下一代大模型GLM-6将实现完全自训练,并计划重点研究模型的自主判断停止与自我纠正能力。