AI 视频换脸,逐帧重建

上传一张源人脸,再上传你想放进去的片段。每一帧都单独做检测、关键点与融合,所以这次视频换脸能穿过运动继续贴合,而不是一闪一闪。

MP4 与 MOV,最大 100MB每条片子 30 积分原声完整保留无水印
订阅后可去除
-10
安全上传快速出图AI驱动

一张静态图只给模型一道题。视频换脸给它的是每一帧一道题,上面还压着更难的一道:帧与帧之间必须互相对得上。二十四次单看都很可信的换脸,只要下颌线在两帧之间挪了一个像素,整段仍然会被看出是假的,因为眼睛对运动的敏感度远高于对细节的判断。正是这种时序稳定性的要求,让一条片子更贵、更慢,也让准备工作比图片活儿有价值得多。

流程内部是这样:每一帧被解码、扫描人脸、定位关键点、换脸、融合回去,再写进新文件。引擎是跑在 RunPod 上的 FaceFusion,所以一次视频换脸通常要 1 到 5 分钟,而一张静态图只要几秒。默认状态下帧与帧之间不传递任何信息:每一帧都独立检测,这既让流程扛得住硬切,也解释了为什么检测不稳会表现成闪烁。

这里没有预置人脸,也没有可供挑选的真人库。源人脸必须是图片,目标可以是图片或视频,两边都由你自己上传,也都由你自己负责。视频换脸固定收 30 积分,与片长无关;图片是 10 积分。免费账号一次性拿 10 新手积分,之后每天再拿 10 每日免费积分,所以一条片子需要付费套餐,或者攒几天的积分。

视频换脸流程到底做了什么

每一帧都单独检测

每一帧都会重新做一次检测、关键点与融合,而不是从第一帧向后插值出一条轨迹。硬切和遮挡都不会带偏整段序列,因为一次视频换脸里的第 400 帧对第 399 帧一无所知。

让闪烁停下来的那几个开关

闪烁是检测问题,不是融合问题。把检测阈值调低,让临界帧也能被认出来;脸小就把检测尺寸调大;再打开参考人脸模式并固定一个参考帧号,就能在整段视频换脸里锁住同一个人。

输出编码全在你手里

高级选项面板里有输出视频编码器、预设、质量、缩放和帧率,所以视频换脸不会让成品比素材更糟。输出音频编码器和音量也在同一个面板里,因为声音是直接原样穿过流程的。

先做帧裁剪,再花积分

帧裁剪的起始帧与结束帧把素材削到你真正要的那一段。帧数少了,同样的 30 积分处理的东西就少,裁得干净的一次视频换脸大约一分钟就回来。

增强开关的代价随帧数放大

面部增强重建换脸区域内的皮肤纹理,画面增强把整段片子放大。两者都不额外收积分,但都会给每一帧增加时间,而在视频换脸里这个时间要乘上帧数,所以要有意识地开。

三步做完一次视频换脸

1

上传源人脸

源人脸必须是静态图片,最大 10MB:一张清晰的正面脸,两只眼睛都要看得见。它决定后面每一帧的身份,所以这里越锐利,整段片子越受益。

2

上传并裁剪目标

放进一个 MP4 或 MOV,最大 100MB。启动视频换脸之前先设好帧裁剪的起始帧与结束帧,因为处理八秒和八十秒收的积分完全一样。

3

跑起来,然后等

多数片段 1 到 5 分钟内完成。页面每 3 秒轮询一次,15 分钟不出结果就停止等待。下载到的是全分辨率文件,原声完整,无水印。

视频换脸 30 积分,图片 10 积分,所以免费账号要攒三天的每日免费积分,或者直接上付费套餐。

什么时候片段比静态图更值

格式本身就决定很多事。下面这些活儿值得为视频换脸多付积分、多等一会儿,而它们的起点都是你手上有权使用的素材。

对话与反应镜头

一张要说话、要眨眼、要有反应的脸,暴露的东西比肖像多得多,所以一次成功的视频换脸说服力也强得多。把镜头留短,把机位放稳。

制作前的造型试验

选角试片和提案样片需要演员动起来,而不是站着不动。一次粗糙的视频换脸五分钟就能回答问题,也比画出来的概念图更诚实。

粉丝剪辑与重剪

给一场戏重新选角、把 cosplay 短片收个尾、拼出没人投资的联动预告,是这个格式用量最大的场景。只裁到承载笑点的那一镜,不要整集都处理。

竖屏短视频

竖屏内容跑得快,也宽容得多。九秒的一刀比一整场戏少太多帧,处理时间压得下来,而视频换脸照样把梗送出去。

把自己的脸放到别处

最不光鲜也最常见的一件事:把自己的脸放进你当时不在场的画面里。错过的旅行片段、缺席的合拍视频、你希望自己也在的那一条。

顺着视频的脾气做,而不是跟它对着干

花积分之前先裁帧、先取景

30 积分买的是一次任务,不是一秒画面,所以第一个决定是你到底需要哪些帧。帧裁剪的起始帧与结束帧就是为此存在的:在启动视频换脸之前,把素材削到承载想法的那一镜。十秒的一刀大约一分钟回来,两分钟的一场戏会逼近 15 分钟的轮询上限,而收费一模一样。先裁,再想参数。

取景在这里比在静态图上更重要,因为脸会随人物移动而变大变小。开头占满画面、结尾只剩四十像素的脸,前半段换得干净,后半段就散掉。要么裁到脸的尺寸一直可用的那一段,要么把检测尺寸调大,让小脸也能被认出来。大全景是你能递给模型的最难的素材。

换脸为什么会闪,以及怎么让它不闪

闪烁几乎从来不是融合阶段的问题。它来自检测:有几帧的人脸掉到检测阈值以下,那一帧就原样穿过去没被换,整段序列于是开始跳。把检测阈值调低,这些临界帧就回来了。运动模糊、急转的侧脸、扫过脸上的阴影是三个常见原因,三个都该用更低的阈值回答,而不是换一个换脸模型。

第二个不稳定的来源是多人镜头里的身份漂移。人脸选择留在多张脸模式时,你的主角一出画,引擎就可能把换脸交给别人。把它切到参考人脸模式,参考帧号设在主角最清楚的那一帧,再调参考位置与参考距离,整段视频换脸就会一直钉在同一个人身上。

别让编码器毁掉前面的工作

每一次视频换脸都要重新编码。流程解码源文件、重写像素、写出新文件,也就是在素材原有的压缩上再叠一代有损压缩。输出视频编码器、预设和质量决定这第二遍要付多少代价。素材本来很干净,却把质量留在低档,是把技术上完美的换脸做得比原素材还难看的最快办法。

帧率同样要小心。输出帧率默认跟随源文件,改动它就会触发重采样,可能带来抖动,而抖动看起来就像换脸的瑕疵,哪怕脸部处理毫无问题。没有具体理由就别动帧率。如果素材真的偏软,画面增强能把整段放大,面部增强能重建换脸区域内的纹理,代价是每一帧多花时间,而不是多花积分。

花掉 30 积分之前先检查这些

一次让人失望的视频换脸,几乎总是输入的问题。模型和跑静态图的是同一个,它不会在两次任务之间变差。变的是素材:脸转过去多少、占画面多大、运动模糊有多重、有多少人在跟检测器抢位置。

因为一条片子的积分是图片的三倍,耗时是它的上百倍,跑废一次很疼。花十五秒看完下面这张清单。现在换一张源照片,或者把镜头再裁一次,都比把同一次视频换脸再等一遍便宜。

  • 源人脸是清晰的正面静态图,小于 10MB
  • 目标片段是 MP4 或 MOV,小于 100MB
  • 帧裁剪的起止只覆盖你要的那一镜
  • 在裁好的范围内,脸的尺寸一直可用
  • 画面里有多个人时,已切到参考人脸模式
  • 你持有素材的权利,也拿到了这张脸的同意

每一条片子都要守的规矩

本页没有预置的真人名册,以后也不会有。围着某位指定公众人物做的一键视频换脸,正是这类工具变成骚扰机器的方式,所以源人脸永远由你自己上传,也永远由你自己负责。用真人肖像制作性内容、且未取得本人同意,一律禁止。把成品做成看似真实、未经编辑的记录,用来讲一件从未发生的事,同样一律禁止;而运动画面恰恰是这件事风险最高的格式,所以值得明说。

戏仿、评论、粉丝作品、提案与制作素材,以及你自己的肖像,都在这个工具的用途之内。编辑过的媒体离开你手里时,请标注为已编辑。法律推进得很快:肖像权与公开形象权、非自愿私密影像相关法规、以及选举场景下的合成媒体规则,今天都带着实打实的处罚。用来针对、性化或诈骗真人的账号会被停止访问,我们也会响应视频换脸中被描绘者提出的删除请求。

视频换脸常见问题

为什么视频换脸要 30 积分,图片只要 10 积分?

因为工作量是按帧算的。30fps 的一秒就是三十次检测、三十次关键点、三十次融合,再加一次完整重编码,而静态图每样只有一次。30 积分与片长无关,所以长片段在每帧成本上更划算,而单靠每日免费积分不够跑完一次。

声音会变吗?

不会。视频换脸只改脸,别的什么都不改。音频原样穿过,唯一的声音设置是输出音频编码器和音量。这条流程里没有声音克隆、没有口型同步、也没有语音生成。

一次视频换脸要多久?

多数素材 1 到 5 分钟,决定因素是帧数而不是文件大小。页面每 3 秒轮询一次,15 分钟后放弃等待,所以很长或者帧率很高的素材最好先裁。

能上传什么文件?

源人脸必须是图片,最大 10MB。目标可以是最大 10MB 的图片,也可以是最大 100MB 的 MP4 或 MOV 视频。其他格式在花掉积分之前就会被拒。

我的视频换脸为什么会闪?

检测器在某些帧上丢了脸。先把检测阈值调低,脸在画面里偏小就再把检测尺寸调大。如果换脸跳到了另一个人身上,把人脸选择切到参考人脸模式,用参考帧号钉住它。

成品上有水印吗?

任何套餐都没有水印。文件按你设定的分辨率和缩放返回,上面没有任何叠加。上传件存在只有你的账号能写入的预签名私有存储里,结果留在你的任务记录中,不会被公开,也不会当作训练数据。

可以先用静态图试一次吗?

可以,而且应该这样做。同一个工具接受图片目标,只要 10 积分,这是在投入一次视频换脸之前确认源人脸好不好用的便宜办法。先在一帧上把身份调对,再跑整段片子。

其他换脸工具

同一套视频换脸引擎,只是对准了另一类源素材。

开始一次视频换脸

上传一张脸,裁好你的片段,然后跑起来。30 积分覆盖一次任意长度的视频换脸。

立刻换脸