DeepSeek、OpenAI 等厂商布局自研 AI 推理芯片
3 小时前

近期,DeepSeek、OpenAI、Anthropic等AI领域的大型企业,在采购英伟达GPU的同时,纷纷着手布局自研AI芯片。这一趋势的核心原因在于,通用GPU在大模型推理的Decode阶段效率低下,数据搬运成本高昂,导致算力严重浪费。此前,由于大模型技术路线尚不明朗,这些大厂对推理芯片的研发并不重视。然而,随着深度推理、AI Agent等技术路线的确立,推理负载急剧增加,专用推理芯片的优势逐渐显现。谷歌早年推出的TPU,通过采用脉动阵列技术有效解决了数据搬运问题。如今,各家大厂在自研推理芯片的路径上各有千秋:Anthropic结合脉动流水线与AWS Trainium,并反向优化编译器;Groq则砍掉HBM显存,转而使用SRAM以提高效率;阿里采用灵活通用架构;OpenAI联合博通从集群层面优化KV Cache绑定;DeepSeek也将根据自身模型技术特点布局推理芯片。展望未来,AI厂商将逐渐从适配GPU转向主动选择适配自身的软硬件,从而摆脱硬件厂商的制约。