Appearance
📰 概要
算力够强了,下一步该补哪里?2026年4月28日,平头哥在数字中国建设峰会上交出了一份答案:发布首款智能网卡**「磐脉 920」**。
这是国内首个内置 PCIe Switch 的 400G 智能网卡,最大支持 400Gbps 吞吐带宽。它的定位很务实——不是做更快的 GPU,而是让已有的算力少浪费一点。
目前磐脉 920 已量产,并将率先部署在阿里云数据中心。
🔍 解读
为什么现在发网卡?
过去两年,行业最热的词是 GPU 和算力规模。但大模型训练有个隐形的瓶颈:万卡集群里,只要一部分节点慢下来,其他节点就只能干等。
目前行业里万卡级智算集群,GPU 实际利用率能到 60% 已算顶尖。
李旭慧打了个比方:「算力是石油,网力是输油管道。」管道不够粗,再强的 GPU 也得排队。
三个关键技术
磐脉 920 的第一个设计是多路径 RDMA,把原来一条高速变成多条同时分流。第二个是内置 PCIe Switch,解决数据绕路问题。
第三个是网络感知和可编程拥塞控制,让网卡从被动传输变为主动调度。实测结果是:大模型训练和推理任务完成时间缩短 14%。
💎 深挖
为什么是网卡,不是芯片?
平头哥的选择很有意思。过去几年,很多芯片公司都在卷 GPU、卷 AI 加速卡。平头哥则在补全一条容易被忽视的链路——网络。
AI 训练时,几千上万张 GPU 要实时同步数据。传统网卡受限于单路径带宽和 PCIe 拓扑,经常成为集群里的「最短板」。
磐脉 920 把 PCIe Switch 直接集成进网卡,让 CPU、GPU 和网卡之间的连接路径更短、更整齐,减少无谓的等待。
全栈布局的四块拼图
随着磐脉 920 发布,平头哥正式形成四条产品线:真武系列 AI 芯片、倚天系列 CPU、镇岳系列存储主控芯片,以及磐脉系列智能网卡。
对应的正是数据中心的四个关键环节:算力、存力、网力,加上通用计算。这套布局的逻辑是:单一芯片产品无法解决全链路问题,只有打通三力,才能最大化释放 AI 硬件性能。
对开发者和企业意味着什么?
如果你在运营大规模 AI 训练集群,磐脉 920 的意义是:同样的 GPU 规模,训练时间缩短 14%。对于分秒必争的大模型迭代,这是不小的优势。
什么情况不建议用?
如果你的 AI 业务规模较小,用的是单卡或小规模集群,网卡升级带来的收益有限。磐脉 920 主要面向万卡级智算集群,部署门槛不低。
你该关注什么?
平头哥这条网卡新品,折射出一个更大的趋势:当算力已经足够强,行业开始关注「效率最后一公里」。GPU 堆得再多,如果网络和存储跟不上,浪费的算力同样惊人。
