歌手换脸:舞台与 MV 片段专用

上传你要用的那张脸,再上传你想放进去的表演素材。歌手换脸引擎能跟住随节拍晃动的头部,也能在频闪灯光下稳住画面。

支持舞台视频与静帧每段视频 30 积分音频原样保留无水印
订阅后可去除
-10
安全上传快速出图AI驱动

音乐素材是换脸引擎最难啃的一类。歌手随节拍摆头,灯光每一小节换一种颜色,话筒又几乎全程横在下颌线上。歌手换脸必须一帧一帧地扛住这些干扰,不能让移植过去的脸从头上滑开。本页跑的是 RunPod GPU 上的 FaceFusion,就是针对这类难题调校的。

先把你要用的脸作为图片上传,再上传目标图片或视频:演唱会片段、MV 剪辑、歌词视频封面、专辑封面、混音带封套都可以。图片换脸花 10 积分,几秒钟就出结果。视频歌手换脸花 30 积分,通常 1 到 5 分钟内完成,因为每一帧都会单独做检测、对齐和融合,而不是拿一次结果糊满整段视频。

这里什么都没有预置。没有预设人脸,没有真人歌手素材库,也没有绑着姓名等你点击的缩略图。歌手换脸的两半素材都由你提供,所以做什么由你决定,两个文件的使用权也由你负责。这是一条刻意划下的限制,它把创作工具和骚扰机器分开。

专为音乐素材打磨

扛住频闪与色片灯光

舞台灯阵一侧甩洋红,另一侧压青色,然后半小节直接黑场。引擎会逐帧给移植过去的脸重新打光,所以歌手换脸不会每次灯光变色就闪出一张苍白的脸。

张嘴唱歌也稳得住

唱歌意味着嘴大半时间是张开的。高级选项面板里的遮罩区域可以保留目标本身的口腔内部,让符合表演的牙齿和舌头留下来,只替换脸的其余部分。这一个开关修好的失败歌手换脸,比其他任何设置都多。

话筒和手挡在脸前

话筒横过下颌,手捂住耳朵,头发盖住一只眼。遮挡模型和分割模型会算出哪些像素在脸的前面,把换脸结果压在它们后面,话筒就不会糊进下巴里。

先裁帧,再花积分

一段四分钟的现场,不管你要全部还是只要八秒,占用的 GPU 时间是一样的。帧裁剪能在任务开始前把片段切短,视频歌手换脸只渲染你真正要留的部分。配合输出帧率和编码器设置一起用效果更好。

私有上传,绝无水印

文件走预签名 R2 存储,只归你的账号所有,成品以完整分辨率进入你的任务记录。你做的歌手换脸不会被公开、不会进画廊、也不会拿去当训练数据,输出上不带任何水印。

从上传到下载只要三步

1

上传源人脸

挑一张清晰的正脸图,两只眼睛都露出来,嘴前不要有遮挡。歌手换脸的源人脸必须是静态图片,绝不能是视频片段,而且清晰度比像素数更重要。

2

放入表演素材

上传你的目标图片或视频:图片最大 10MB,视频最大 100MB。舞台片段、MV 剪辑、封面图、缩略图都行。目标决定最终的姿态、光线和构图,也决定这次歌手换脸能到什么水准。

3

渲染并下载

静态图 10 积分,几秒出结果。视频歌手换脸 30 积分,通常需要 1 到 5 分钟。GPU 干活的时候页面会持续轮询,完成后直接把文件给你,上面没有水印。

每个账号开局有 10 新手积分,之后每天还会拿到 10 每日免费积分,足够每天在静态图上做一次歌手换脸,等真的不够用了再考虑付费套餐。

大家真正用它做什么

歌手换脸只是一个容器,装进去的内容才是关键。下面这五件事它做得踏实,而且每一件的起点都是你已经有权使用的素材。

MV 粉丝剪辑

把喜欢的 MV 换上另一位主唱重新剪,或者补完唱片公司从没谈成的合作。粉丝剪辑是所有人打开歌手换脸工具的第一大理由,成败全看编舞动作跟不跟得住。

专辑与混音带封面

封面图要的是一个精确姿态、一种精确打光的脸,图库里根本找不到。这周就要发的单曲,用一次歌手换脸放进你自己搭好的构图,比再约一次拍摄划算得多。

歌词视频缩略图

缩略图成败全在第一帧的那张脸上。歌手换脸能给你那个当天没拍到的表情,还正好落在平台真正显示的裁切范围里,不用再花一个下午进棚。

戏仿与评论

把一位表演者的脸放到另一位的舞台上,这个玩法历史很长,而针对公众人物的讽刺在多数地区受到较宽的保护。把意图摆明,把文件标注为已编辑,戏仿性质的换脸就站在这个传统里面。

把自己放上舞台

最安静也最常见的用法:把自己放进一场从没参加的演出里。乐队宣传图样稿、缺席拍摄的队友,或者给一个只在浴室唱歌的人做条生日祝福。

让换脸在舞台素材上贴牢

光线才是这里的主战场

演唱会灯光是大多数舞台换脸翻车的原因。日光下或柔和影棚主光下拍的源照片,肤色中性、阴影均匀;而目标帧里可能是舞台左侧一片硬洋红,加一道从另一侧切过来的青色轮廓光。引擎会逐帧重新打光,但只能利用源图给出的信息,所以源图的光线方向如果大致对上目标,歌手换脸就赢在起跑线上。

频闪和黑场是另一码事。硬闪光下抓到的帧几乎没有可用细节,接近全黑的帧更少。把面部增强打开,让换过的区域走一遍修复;素材本身就是从场地后排用手机拍的,再加上画面增强。这两个开关都不额外扣积分,只多花几分钟,所以现场素材一律全开。

嘴、话筒和一切横过脸的东西

歌手唱到长音时嘴是大张的,这恰恰是音乐素材最鲜明的特征。换脸会替换脸部区域但继承目标本身的口腔内部,这通常正合你意,因为和元音对得上的牙齿与舌头看起来才真。打开遮罩区域,把嘴排除在替换之外。闭嘴的源人脸配一张唱到一半的目标帧,就是最经典的失败歌手换脸。

话筒是另一个常客。手持话筒在现场几乎全程横过下颌和下巴,头戴式的悬臂则从颊侧切过。遮挡模型和分割模型能处理这些,但如果话筒渗进了下巴,就把下半部分的遮罩留边加大,再把检测阈值稍微降一点,让跟踪不掉锁。遮挡处理就是干净结果和一张融进话筒的脸之间的分界。

一次只改一个参数

歌手换脸沿发际线出现明显接缝,说明遮罩太紧,解决办法是遮罩羽化。表演者在动,脸却一帧一帧地闪,说明检测阈值定得太高,降低一点让模型能穿过运动模糊继续跟踪。如果换脸跳到了话筒架后面的吉他手身上,把选择器切到参考人脸模式,再把参考位置钉在你要的那张脸上。

分辨率不匹配是最后一个常见原因。用一张超大的源图去配 720p 的舞台片段没有帮助,因为换过的区域会被缩小去适配目标,多出来的细节直接丢掉。真正有用的是一张脸在自己画面里占比够大的源图。每次尝试只改一个参数,否则你迟早会渲出一个好结果,却完全不知道是刚才动过的六个设置里哪一个立了功。

渲染之前先过一遍

几乎每一次拉胯的歌手换脸,根源都在素材而不在模型。引擎不会在两次任务之间悄悄变差,高级选项面板也救不回一张本来就不可能成立的源照片。变的只有你递进去的那两个文件。

在为一段视频花掉 30 积分之前,先看一遍这份清单。它只要十五秒,却能省下多数人慢慢学会同一个道理时白烧的三四次失败渲染。

  • 源人脸是清晰的正脸静态图片
  • 源人脸的嘴形与目标大致一致
  • 源人脸的光线方向对得上舞台灯光
  • 遮罩区域保留了目标本身的口腔内部
  • 目标图片小于 10MB,或视频小于 100MB
  • 两个上传文件的使用权和授权都在你手上

本页每一次换脸都要守的规矩

本页没有真人歌手名册,以后也不会有。每一次歌手换脸都从你自己上传的源人脸开始,也就是说,那张脸是谁的,由你负责。用真人肖像制作性内容、且未取得本人同意,一律禁止,公众人物没有例外。同样禁止的是任何被做成看似真实、未经编辑的照片或录音的产物:伪造一场从未发生的演唱会画面,或者把一段编造的发言塞进某位表演者的嘴里再当真事传播,正是本工具明确拒绝的用途。

它该用在哪里:戏仿、评论、粉丝作品、提案与制作素材,以及你自己的肖像。编辑过的媒体离开你的电脑时,请标注为已编辑,一行说明不花钱,却能第一时间把问题讲清。法律层面也不是空谈。肖像权与公开形象权、非自愿私密影像相关法规、以及选举场景下的合成媒体规则,现在都带着实打实的处罚。用来性化、诈骗或针对真人的账号会被停止访问,我们也会响应被描绘者提出的删除请求。

歌手换脸常见问题

它会改变声音吗?

不会。这个工具只换脸,别的都不动。原始音轨原样通过,所以歌手换脸不会碰录下来的人声。这里没有声音克隆。高级选项面板里设置的是音频编码器和音量,那属于封装,不是合成。

工具里内置了真人歌手吗?

没有预设,没有带姓名标签的缩略图,也没有公众人物库。源人脸和目标图片或视频每次都由你自己上传。这是设计决定,不是功能没做完。

视频歌手换脸要多久?

多数片段 1 到 5 分钟,取决于时长和帧率,因为每一帧都要单独做检测和融合。页面在后台轮询,超过十五分钟就放弃。如果四分钟的现场里你只要八秒,先用帧裁剪切掉其余部分。

价格是多少?

图片歌手换脸 10 积分,视频 30 积分。新账号有 10 新手积分,另外每天还有 10 每日免费积分,所以轻量使用不花钱。面部增强和画面增强开启免费,只多花处理时间。

可以上传什么文件?

源人脸必须是图片。目标可以是最大 10MB 的图片,或最大 100MB 的视频。静态图支持 JPEG、PNG 和 WebP,视频支持 MP4 和 MOV。超出范围的文件会在扣积分之前被拒。

为什么我的歌手换脸嘴看起来不对?

几乎总是嘴形不匹配:闭嘴的源人脸配上一张唱到一半的目标。换一张嘴形接近的源人脸,再检查遮罩区域是否保留了目标本身的口腔内部,而不是把它一起替换掉。

你们会留着我上传的文件吗?

文件放在绑定你账号的私有预签名存储里,供 GPU 工作节点读取,每一次完成的歌手换脸都留在你的任务记录中,直到你自己删除。任何内容都不会被公开、展示给其他用户,或用于训练模型。

其他换脸页面

和这个歌手换脸背后同一套引擎,只是针对另一类源素材做了调校。

开始一次歌手换脸

上传一张脸和一段表演,今天的免费积分就够你完成第一次歌手换脸。

打开工具