AI视频对口型,简单说就是让视频里的人物嘴巴动起来,跟他说的台词一字不差地对上。
你可以想象成三步:
第一步,先给AI一段人物说话的音频(比如“今天天气真好”)。
第二步,再给AI一张人物照片或者一段没有说话的原始视频。
第三步,AI会“听懂”音频里每个字是怎么发音的,然后自动算出嘴巴应该张多大、嘴唇怎么收、舌头大概什么位置,再把这些动作“贴”到人物的脸上,同时还会微调周围的脸部肌肉和下巴,让画面看起来自然。
整个过程就像给木偶配音时,有人在一旁精准地拨动木偶的嘴,只不过这个“拨动”是AI用算法在像素级别上完成的。现在很多工具只需要上传一张脸和一段语音,几秒钟就能生成对好口型的视频。 |
|