9月22日,2026杭州云栖大会上,阿里巴巴(BABA)集团CEO吴泳铭在主题演讲中,将AI模型、AI芯片、AI云定义为“机器智能”时代的三大基石,并用一个比喻点出芯片的位置:“如果说Token是AI时代的电,芯片就是发电机。”
同日,这家公司给出了“发电机”清单的最新一页:平头哥发布新一代训推一体AI芯片真武V900,并首次公开倚天服务器CPU的产品路线图。平头哥方面称,其数据中心核心芯片已覆盖AI芯片、服务器CPU、互联、网络和存储等环节。
单芯片性能提升至三倍
据介绍,真武V900基于自研并行计算架构设计,搭载216GB大容量显存,片间互联带宽达1200GB/s,单芯片性能为上一代真武M890的3倍,原生支持FP8、FP4低精度计算,可覆盖万亿级参数大模型的训练与推理全场景。吴泳铭称,这是目前中国算力性能最强的AI芯片。
按照规划,该芯片将于2027年第一季度量产售卖,并在阿里云数据中心规模化部署。
V900通过平头哥自研的ICN Switch互联芯片实现千卡全带宽高速互联,具备原生内存语义与内存统一编址能力,上千颗芯片可像一颗“超级芯片”协同工作。
与之配套的新一代磐久超节点服务器,集成真武V900、ICN Switch、磐脉智能网卡及镇岳SSD主控芯片,实现算、存、网全栈系统级协同,结合阿里云新一代网络架构,单一集群可扩展至50万卡规模。
上一代产品已经过验证:基于M890的超节点已大规模应用,跑通Qwen3.8、Kimi K3等超2万亿参数大模型。截至2026年6月,真武系列已服务超过650家企业客户。
吴泳铭表示,由于平头哥芯片产品线的成熟和客户的广泛应用,其AI芯片年出货量将大幅提升。
CPU路线图首次公开
Agent的任务规划、状态管理、工具调用、代码沙箱与多Agent编排高度依赖CPU,海量数据(603138)的预处理与吞吐同样离不开它。
平头哥此番首次公布倚天服务器CPU规划:2027年推出倚天720和倚天730两代产品,前者将实现单核性能、核密度与能效的全面提升,后者首次基于全自研CPU微架构设计,单核SPECint2017/GHz性能最高可达倚天710的1.4倍;后续还将推出搭载第二代自研核的倚天750,支持自研ICN片间互联总线协议,使CPU与真武AI芯片直接互联。
加上真武AI芯片、倚天服务器CPU、ICN Switch互联芯片、磐脉智能网卡、镇岳存储主控芯片,平头哥方面称已实现算力、网力、存力的数据中心核心芯片全栈自研。
模型开始反哺芯片设计
芯片之外,阿里首次集中展示“芯片—模型—云”协同飞轮,其中一项是模型参与芯片设计:仅基于一份真实的芯片模块规范,Qwen3.8-Max自主运行超过60小时、调用EDA工具逾万次,完成从功能架构设计、验证到物理实现的完整流程,将模块物理面积压缩42%。而更好的芯片硬件又将加速模型智能的持续突破,在芯片和模型间形成一个自主迭代的循环。
反向优化同样发生在推理侧。在真武M890上,Qwen3.8-Max“从零适配”全新模型并交付可运行的推理栈,相较首个可用版本,长文本首Token延迟与每输出Token延迟分别下降47%和60%,日常对话场景单实例吞吐提升96%。
来自云上业务的需求,也在反向影响下一代芯片的产品路线。规划中的倚天730面向AI Head Node强化单核性能,倚天720则以192核支持Agentic Rack的大规模并发执行;后续倚天750还将通过ICN总线与真武AI芯片直接互联,提高协作效率。下一代训推一体AI芯片真武V900,则进一步面向更大模型和更长上下文升级。配合超节点架构与云平台优化,这些硬件能力将为后续模型训练、推理和Agent服务提供支撑。
吴泳铭表示,当前客户AI需求强劲,行业中长期需求远超供给能力,全球AI数据中心相关供应链的紧缺仍在限制算力增长速度。阿里巴巴(BABA)将与合作伙伴共同投入AI基础设施建设,目标是到2032年,阿里云运营的全球数据中心规模超过20GW,以满足快速增长的AI需求。
■新快报记者郑志辉
