新京报
常见流程包括人脸检测、关键点定位、身份特征提取、脸部生成或融合,以及边缘修复。素材清晰度、拍摄角度、光线变化和动作幅度都会影响结果。正面、光线稳定、无😎遮挡的视频通常更容易生成自然效果;侧脸、快速转头、多人同🎆框或面部被手遮挡时,容易出现五官变形、边缘闪烁和表情不连贯。
AI合成声则是从文字生成语音,或者根据一段参考音频提取音色、语速、停顿和语气特征,🔑再合成新的讲话内容。它不只是把声音的音调升高或降低,还可能模拟说话节奏、情绪变化和发音习惯。音频样本越清晰、☀️环境噪声越少,生成效果通常越稳定。
需要注意的是,换脸和合成声并不是简单的“复制粘贴”。它们往往会对原始素材进行分析、预测和重新生成,因此即使画面或声音很逼真,也可能在细节处留下痕迹,例如嘴型与语音不同步、咬字过于均匀、背景反射异常、情绪与语境不匹配等。
明星的脸部形象和声音通常具有较高的识别度与商业价值。未经许可把这些特征用于广告、商品宣传、账号引流或付费内容,可能使公众产生“明星代言”“明星发言”或“明星参与项目”的错误判断。即使发布者标注了“AI生成”,也不能自动消除由误导、侵权或不当使用造成的责任。