前提:使用 inswapper_512 模型,显存≥10GB;显存8GB把分辨率降到384,开启FP16。
法律提示:仅用于本人或拥有完整书面授权素材;对外输出必须标注AI深度合成。
核心模型设置
换脸模型: inswapper_512
人脸检测器: retinaface (影视视频人脸检测最稳,不要用yolo,侧脸容易漏)
人脸解析器: bisenet_resnet_18 (掩码质量最高,减少边缘撕裂)
人脸掩码类型: box‑mask → soft‑mask(软遮罩,电影必开!)
掩码模糊: 7‑11 ,推荐 9(人脸边缘柔和融合,消除硬边界)
掩码填充: 3‑6 ,推荐 4(避免脸边缘黑边、缺口)
换脸推理参数(关键,决定光影融合)
人脸修复器:codeformer(优先,电影质感;不要用gfpgan,容易过度磨皮塑料脸)
Codeformer权重:0.4‑0.6,推荐0.5
0=原图细节;1=强美颜;0.5兼顾皮肤纹理又修复瑕疵,最接近真人电影。
人脸放大: off ,不要在这里做超分!后期剪辑软件做放大,这里放大极易闪烁。
推理精度: fp16 (显存≥12G可开fp32,画质微小提升,显存暴涨)
性别强制:auto,不要手动锁性别,部分镜头会崩坏。
视频防闪烁|时序稳定【电影最重要一组】
不配置这组,画面会帧跳、肤色忽明忽暗,没有电影感
帧间参考:开启(frame‑projection)
帧间投影权重: 0.25‑0.4 ,推荐 0.3
太高会继承旧帧瑕疵;太低抑制闪烁效果差。
颜色转移(色彩迁移):开启 color‑transfer
色彩迁移模式:lab(Lab色彩空间肤色匹配,光影跟着原视频走,不要rgb)
人脸阈值:0.65;人脸距离阈值:0.85(过滤错误人脸,防止背景物体乱换脸)
最大人脸数量:1(单人物视频;多人场景改为对应人数)
输出编码与预处理
分辨率:保持原视频分辨率,不建议工具内强行升分辨率
输出编码器:h264‑nvenc(N卡硬件加速) / libx264
输出质量crf:18‑20,CRF18接近无损,避免压缩带来的人脸破碎
音频:复制原视频音频,不重新编码
跳过已处理帧:关闭(做成片务必关闭,避免跳帧)
⚠️避坑清单(很多人电影效果差的根源)
1. ❌不要开启多个修复器叠加,只开codeformer。gfpgan会把皮肤磨成塑料,失去电影胶片质感。
2. ❌不要把codeformer权重调到0.7以上,会丢失毛孔纹理。
3. ❌不要关闭soft‑mask,box‑mask硬边缘一眼AI。
4. ❌不要在FaceFusion里面做超分、降噪;全部丢给后期PR/剪映处理。
5. ❌剧烈晃动、大侧脸、遮挡严重镜头,单独裁剪处理,不要整段硬跑。
后期二次调色流程(出电影质感必不可少)
FaceFusion只做换脸,光影环境统一靠后期软件:
1. 匹配原视频色温、曝光、对比度
2. 轻微降噪,还原胶片颗粒(少量颗粒会极大降低AI感)
3. 轻微肤色统一,消除局部肤色偏移
4. 输出成品。
两套快速预设直接照抄
预设A|高画质成片(显存≥10G,正式短片)
预设B|8G显存低配妥协(还能保持不错影视效果)
实操小技巧
素材优先选光线柔和、人脸无剧烈侧转的片段;强光逆光片段换脸天然效果差。
如果出现人脸颜色忽黄忽白,优先加大 frame_projection_weight ,其次确认开启lab色彩迁移。
如果人脸边缘糊掉:减小mask_blur;出现黑缺口:加大mask_padding。