SD保姆级AI人像换脸教程,无需训练,一键换脸
AI技术效果已经越来越强大了。大家现在看到的是一段普通的小姐姐跳舞视频,我有个想法:能不能把视频里的人脸换成自己喜欢的人脸?别眨眼,看最终效果。接下来详细教大家这种视频换脸效果的制作方法,只用Stable Diffusion就能轻松实现。话不多说,直接上教程。
刚刚演示的视频换脸效果,全程使用Stable Diffusion完成。本次教程主要用到两款插件和一款辅助工具,这两款插件我之前也给大家分享过。第一款是TemporalKit视频处理插件,用于视频帧拆分与合成;第二款是Roop换脸插件,用来实现人像换脸效果;额外搭配Absence视频去闪烁工具,解决成片闪屏问题。这些工具的基础下载和安装教程我之前已经分享过。
没有安装或者不会操作的同学,可以查看本期视频简介,我把插件链接、配套工具、完整安装使用教程都放在简介里了。这里重点提醒一个新版本报错问题:如果你的Stable Diffusion WebUI更新到V1.5.0及以上版本,我当前使用的是V1.5.1版本,安装使用TemporalKit插件大概率会出现扩展冲突报错。
该报错的特殊问题在于:即便删除TemporalKit插件,WebUI依旧无法正常启动。我给大家分享专属解决方法:可以提前备份WebUI文件,或者直接重装WebUI,我这里选择重装操作。
出现该报错后,先进入WebUI根目录,找到VENV虚拟环境文件夹并打开,逐层进入子目录,找到两个TQ开头的异常缓存文件并删除。我这边已经提前清理完成。
删除文件后,在当前文件夹空白位置右键,选择在终端中打开。如果没有该选项,手动输入PowerShell或CMD回车打开命令窗口。将修复指令粘贴到窗口中,回车运行,等待指令执行完毕后关闭窗口。
返回WebUI根目录,双击启动程序,软件会自动重新安装缺失的依赖文件,修复完成后,TemporalKit插件即可正常使用。
解决完报错问题,正式开始视频换脸实操。首先打开TemporalKit插件,上传需要处理的原视频。本次演示使用的是一段14秒的人物跳舞视频。
接下来讲解核心参数设置。画面帧数倍率参数,设置为2会生成4帧画面,设置为3会生成9帧画面。帧数越多,后续换脸工作量越大,新手直接设置为1,仅生成单帧画面即可。
分辨率参数参考原视频属性,本次原视频分辨率为1080×1920,竖向高度为1920,参数直接填写1920。如果电脑显卡配置一般,可以适当降低参数,比如设置为1024,软件会自动适配缩放视频尺寸。
视频帧率按照原视频设置,本次原视频为30帧每秒,参数默认30即可。关键帧间隔参数保持默认,效果稳定。关键帧数量计算方式:帧率除以间隔帧数,本次30÷5,每秒生成6个关键帧,14秒视频总计生成84个关键帧。
参数设置完成后,务必勾选视频切割功能。新建一个空白文件夹作为输出目录,本次新建test文件夹,复制文件夹路径,粘贴到插件输出地址栏。关键帧边界参数默认即可,无需改动。最后确认勾选视频切割选项,点击运行,等待后台自动拆分视频帧。
运行完成后,打开新建的test文件夹,拆分后的所有画面帧都会保存在input文件夹内,本次一共拆分出84张画面帧。接下来开始批量换脸操作。
返回Stable Diffusion页面,切换到图生图功能界面。从刚刚拆分的input文件夹中,任意选取一张画面导入,作为参考底图。
根据自身需求微调基础参数,画面尺寸必须和原视频帧尺寸保持一致,点击尺寸匹配按钮自动适配。重绘幅度建议从0.1开始逐步微调。随后打开Roop换脸插件。
在插件中上传需要替换的目标人脸,点击启用插件,两款换脸算法任选其一即可。人脸融合透明度参数,数值越大,画面越贴近目标人脸;数值越小,越保留原画面人脸特征,本次默认参数1。无需额外放大画面,其余参数保持默认。
重点注意:Roop插件目前仅适配真人写实换脸,二次元画面适配效果较差。大模型务必选择写实真人模型,本次使用Chillmix写实模型。参数全部设置完成后,点击生成,即可完成单张画面换脸。
生成完成后,对比原图和换脸效果图,微调重绘幅度和插件参数,调试出自然贴合的人脸效果。单张画面调试无误后,开始批量批量处理所有画面帧。
将输入目录设置为刚刚拆分好的input文件夹路径,输出目录设置为test文件夹内的空白output文件夹路径,其余参数无需改动,直接点击批量生成。
我电脑配置一般,批量生成耗时11分钟。生成完成后,所有换脸后的画面帧都会保存在output文件夹中。逐一检查成片画面,若存在瑕疵,对应记下瑕疵图片序号,返回input文件夹找到原图,重新微调参数生成修复,替换output文件夹内的瑕疵图片,保证所有画面帧效果统一。
所有画面帧修复完成后,返回TemporalKit插件,找到最后一项Absence视频合成功能。将总输出路径设置为外层test文件夹路径,重新导入原视频,帧率、分辨率、批次参数和前期设置保持一致。
帧数最大值根据视频总帧数计算,30帧每秒、14秒视频总计420帧,参数设置为450,预留充足帧数空间,其余参数默认,点击运行合成视频。
合成完成后,画面帧会分类保存在0、1、2、3、4分文件夹中。接下来打开提前解压好的Absence去闪烁工具。
将合成文件夹内的frames文件拖入工具video目录,case文件夹内容拖入工具对应K目录。工具单次仅支持处理20张图片,分批依次处理所有文件夹内的画面,逐一对所有画面帧做去闪烁优化。
全部画面优化完成后,返回Stable Diffusion插件页面,无需修改任何参数,直接点击合成按钮,快速导出完整成片视频。
合成完成后,可直接在插件内下载视频,也可以在test文件夹中找到生成的MP4成片。
AI合成成片容易出现时长和原视频不匹配、时长偏差的问题,手动精准计算帧数难度较大。这里教大家用达芬奇软件校准时长:新建项目,分别导入原视频和AI换脸成片,将两段视频拖入剪辑轨道。
可以明显看到换脸成片时长短于原视频,画面时长对不上。鼠标右键点击成片,打开变速控制,添加变速关键点,拖动画面拉伸时长,精准匹配原视频时长。
时长校准完成后,可以替换、添加喜欢的背景音乐,裁剪多余画面片段。最后设置保存格式为MP4、比特率3000、固定码率,添加到渲染队列,等待渲染导出即可,最终成片效果自然流畅。