人脸伪造是当前最成熟、应用最广的形式,包括换脸、表情操控和人脸生成,可让一个人的脸出现在另一人身上,或生成当事人从未参与拍摄的画面。
基于语音克隆技术,仅需采集目标人物数秒的语音样本,即可习得其音色、语调、语速乃至口头禅,合成足以乱真的"本人语音",部分开源工具已支持上传录音、输入文字一键生成。
结合换脸与唇形同步,可篡改人物口型与神态,伪造虚假表态发言,甚至凭空虚构人物形象与完整叙事场景。
借助扩散模型等技术,深度伪造已从单纯换脸扩展到全身视频生成、虚拟场景合成等更复杂的形态。