重新构图

转成竖屏,就是把画面的三分之二丢掉

你的素材是 16:9,而 TikTok、Reels 和 Shorts 是 9:16。这两个数字之间的一切都是关于「丢掉什么」的决定,一旦决定错了,瞬间再好、字幕再好,片段看上去都是坏的。这是几乎没人谈论的部分,也正是它决定一个片段看起来像人做的还是像脚本做的。

两个省事的答案,以及它们为何都失败

居中裁剪取中间那条并填满屏幕。在特写上很有力,在全景上是灾难:球传到边路,裁剪后的画面根本不显示,你看到的只是对一个看不见的动作的反应。

加黑边把整幅画面缩小并补上条带。什么都没丢,但什么都很小,整条片子这样处理,看起来就像「视频的视频」。

真正的错误是把重新构图当成一次性的全局决定。正确的构图不是视频的属性。它随时刻变化,所以决定必须跟着变,然后在每个镜头内部稳住,让画面既不抖也不飘。

它逐个镜头选择什么

镜头切换划定边界,边界之间的每一段按自身条件构图。有人说话的内容又加了一个维度:一个人、两个人还是一整桌,各自需要不同的版式;既不把谁挤出画面,也不把所有人压进一条细带,这才是大部分工作。

特写跟随

由一个人撑起这个瞬间。画面跟住说话的人并保持稳定,而不是慢慢飘走,因为一个一呼一吸的画面即使居中正确,也会被读成错误。

全景,按主体构图

把全景居中裁剪是经典的失败:足球片段里球传到边路,你只看到对看不见动作的反应。这里画面保持足够宽以留住动作,并对准真正的主体而不是几何中心。

分屏

两个人对话。画面一分为二,各给一个特写,这正是一来一往所需要的。当其中一人单独撑起这一段时,立刻回到单一画面。

多人宫格

三到四位讲话者,各占一格。四人访谈做成宫格,在手机上的可读性是裁剪后的会议画面永远达不到的。

叠加摄像头

游戏实况、录屏和直播,小摄像头待在角落。主体内容占据上方,摄像头获得自己的条带,而不是让裁剪二选一、丢掉另一个。

整幅画面

标题卡、全屏图形和幻灯片。有些东西只有完整才成立,所以完整呈现,而不是裁到失去意义。

最终拍板的是你

无法修改的自动构图比不做自动化更糟,因为它判断失误的那一个镜头,正是让你发不出去的那一个。在编辑器里可以只为某一个场景设定构图而不影响片段其余部分,也可以用手拖动裁剪框。这些按场景的选择会一路保留到导出,这听起来理所当然,却正是多数预览默默无法保证的事。

诚实的部分

这里没有一个聪明的模型。是计算机视觉和音频在支撑判断,而这些判断要拿真实素材一遍遍地调,看哪里不对就改哪里。大部分进步来自那些把它弄崩的视频:节奏快的足球比赛、多主持人的播客、一张脸都没有的录屏。

快节奏体育是工作仍在继续的地方,也值得把已经成立的部分说清楚。一场比赛的全景恰恰是居中裁剪失败得最厉害的场面:球一旦传到边路,裁剪其实早已把那部分场地丢掉了。这里画面保持足够宽以留住动作,并对准动作本身而不是画面正中。它还做不到的,是在同一个连续镜头内部跟住比赛,像摄影师那样。构图质量不是一项会做完的功能。对一个剪辑工具来说它就是全部胜负,所以这项工作还在继续。想知道今天做到哪一步,丢一条视频进去,看它如何构图每一个瞬间。

常见问题

为什么不全部居中裁剪?

因为它在特写上有效,在其他一切上都失败。把全景居中裁剪,恰好删掉了这个镜头之所以存在的那部分画面。这是自动剪辑的视频看起来坏掉的最常见原因,哪怕选中的瞬间是对的。

为什么不全部加黑边?

什么都没丢,但什么都很小。整条片子都是黑边,看起来就像「视频的视频」。加黑边对标题卡是对的,对对话是错的,这恰好说明为什么不能对整条片段一次性决定。

我能改掉它选的构图吗?

可以,按场景改。编辑器允许只设定某一个镜头的构图而不碰其他镜头,而且这些选择会保留到导出,不是预览里的假象。

画面里没有人时还有效吗?

那正是让粗糙检测器失效的情况,所以被明确处理:没有人的录屏或空镜段落,会按内容构图,而不是去对准一张并不存在的脸。

它如何应对快节奏体育?

它把比赛留在画面里,这是居中裁剪做不到的:在全景里,裁剪恰好切掉了动作刚刚转移过去的那片场地。它还做不到的,是在一个连续镜头内部像摄影师那样跟住比赛,因此一段不间断的长回合是被构图而不是被跟踪。这部分仍在打磨中,与其让你在一场比赛里发现,不如我们先说。

是一个模型在决定一切吗?

不是。是人脸和人体检测、镜头切换检测、说话人分离和音频,共同驱动一组规则,而这些规则是拿会把它们难住的素材调出来的。大部分进步来自失败,不是成功。

看它如何给你的素材构图

有意思的测试不是一个正面出镜的讲话画面。给它一段带全景、带标题卡、不止一个人的素材,看看画面往哪儿走。