Skip to content

平头哥磐脉920:补齐AI算力最后一块短板,万卡集群不再「堵车」

2026年5月8日

📰 概要

GPU买了那么多,跑起来却像堵车。

2026年4月28日,平头哥在数字中国峰会发布首款智能网卡「磐脉920」。最大支持400Gbps吞吐带宽,面向万卡级AI智算集群。

问题背景:当前万卡集群GPU利用率普遍低于60%。瓶颈不在GPU本身,而在网络传输效率。磐脉920内置PCIe Switch,减少数据流转时延,系统成本降低30%。

🔍 解读

这不是简单的"又一张网卡"。

AI算力行业前两年的焦点是"买卡"——谁家有更多GPU,谁就更有优势。但现实是:GPU堆到一定程度,系统效率反而下降。

磐脉920的定位是"输油管道":当算力规模达到万卡级别,网络传输效率成为瓶颈。平头哥产品总监李旭慧的比喻很准:"算力是AI时代的石油,网力就是输油管道"。

换个角度想:你花几百万买一批顶配跑车(GPU),结果因为路太窄(网络瓶颈),只能一辆一辆慢慢开。

💎 深挖

60% vs 提升空间

当前行业万卡智算集群的GPU利用率,能做到60%已经是"行业顶尖水平"。这意味着40%的算力资源处于闲置或等待状态。

原因不是GPU不够强,而是系统调度效率不足。AI训练需要几千甚至上万张GPU同步协作,只要一部分节点慢下来,其他节点就只能等待。

磐脉920的目标不是"造更快的车",而是"修更宽的路"。

内置PCIe Switch的技术突破

传统方案中,PCIe Switch外接在网卡和服务器之间。磐脉920把PCIe Switch集成到网卡内部,减少了一层外部交换芯片的依赖。

这相当于把"收费站"建在路口内部,而不是500米开外。数据从GPU到网卡再到其他节点的路径更短,时延更低。

技术细节:支持400Gbps吞吐带宽,400Mpps收发包率,适用于万卡智算集群、通算集群和高性能存储场景。

系统成本降低30%

平头哥公布的数据:磐脉920能降低整体系统成本30%。这个数字背后,是硬件采购成本、电力消耗、运维复杂度三方面的综合优化。

对于阿里云这样的云服务商来说,30%的系统成本降低,意味着同等算力规模下,能开出更低的客户价格,或者同等价格下提供更强服务。

已量产,率先部署阿里云

磐脉920不是"PPT产品",而是"发布即量产"。目前已经率先部署在阿里云数据中心,开始服务实际客户。

这意味着技术验证已经完成,商业落地已经开始。其他云服务商和智算中心,大概率会跟进类似方案。

什么情况不建议用

如果你只是小规模AI训练(几十张GPU),传统网卡够用了。磐脉920的目标是万卡级别集群,小规模场景的边际收益不明显。

另外,如果你已经投资了另一套智能网卡方案,切换成本可能超过收益——除非你的算力规模已经达到瓶颈,否则没必要立刻更换。

什么情况这趋势还会继续

AI算力行业正在从"堆硬件"转向"优化系统效率"。磐脉920只是开始,后续会有更多类似产品出现。

最终受益的是AI应用开发者:你花同样的钱,能买到更高的实际算力利用率。这对大模型训练、科学计算等重负载场景,是实实在在的效率提升。

不要孤军奋战啦!

加入微信群一起学习交流 AI

与大神一起使用 OpenClaw、Hermes、Claude Code、Seedance 2.0、GPT-Image-2 等

微信公众号

扫码关注微信公众号
私信 "加群",将自动获取微信群二维码

探索 AI 世界,掌握智能未来