リフレーム

縦にするとは、画面の3分の2を捨てること

素材は16:9、TikTokもReelsもShortsも9:16です。その差のすべては「何を失うか」という判断であり、ここを外すと、どれだけ良い瞬間でも、どれだけ良い字幕でもクリップは壊れて見えます。ほとんど誰も語らない部分でありながら、そのクリップが人の手によるものか、スクリプトによるものかを決める部分です。

安易な2つの答えと、どちらも失敗する理由

中央切り抜きは真ん中の帯を取って画面を埋めます。寄りの画では力強く、引きの画では致命的です。ボールがサイドに流れても、切り抜きはそれを映しません。見えない動きへの反応だけを見ることになります。

レターボックスは画面全体を縮めて帯を足します。何も失われませんが、すべてが小さくなり、それだけで一本通すと「動画の動画」に見えます。

本当の誤りは、リフレームを一度きりの全体判断として扱うことです。正しい構図は動画の属性ではありません。瞬間ごとに変わるのだから判断も変わるべきで、そのうえで各ショットの中では動かず、揺れも流れもしないように保つ必要があります。

ショットごとに選ぶもの

カット位置が区切りを決め、その間の各区間はそれぞれの条件で構図が決まります。会話のある素材はもう一つの軸を足します。1人、2人、あるいは複数人の卓は、それぞれ別のレイアウトを求めます。誰かを画面外に追い出さず、全員を細い帯に押し込めずに選ぶこと、それが作業の大半です。

寄りの追従

1人がその瞬間を担っている場合。枠は話し手を追い、流れずに保たれます。呼吸するように動く枠は、正しく中央に置かれていても誤りに見えるからです。

引きの画、被写体に合わせて

引きの画を中央で切るのが典型的な失敗です。サッカーならボールがサイドに流れ、見えない動きへの反応だけが映ります。ここでは動きを保てる広さを維持したまま、幾何学的な中心ではなく実際の被写体に合わせます。

分割画面

2人の対話。枠が分かれてそれぞれに寄りを置きます。やり取りに必要なのはこれです。片方が単独で区間を担い始めた時点で、単一の枠に戻ります。

複数人のグリッド

3人または4人が、それぞれのセルに入ります。4人のインタビューをグリッドにすると、切り抜いた会議画では決して得られない読みやすさがスマートフォンで得られます。

ワイプ(重ねカメラ)

ゲーム実況、画面収録、配信など、小さなカメラが隅にある素材。本編が上部を取り、カメラは専用の帯を得ます。どちらかを選んでもう一方を失う切り抜きにはなりません。

全画面のまま

タイトルカード、全画面のグラフィック、スライド。全体でしか意味をなさないものは、意味を失うまで切らずに、そのまま見せます。

最終判断はあなたのもの

直せない自動構図は、自動化しないよりたちが悪いことがあります。外した1ショットこそ、公開を止めるものだからです。エディタでは、クリップの他を触らずに1つのシーンだけ構図を決め、切り抜き枠を手で動かせます。そのシーン単位の選択は書き出しまでそのまま通ります。当たり前に聞こえますが、多くのプレビューが黙って保証しない点です。

正直なところ

これは一つの賢いモデルではありません。画像処理と音声が判断を支え、その判断を実素材に対して何度も調整し、崩れる箇所を見ては直しているだけです。進歩の大半は、うまくいかない動画から来ます。速いサッカー、複数人のポッドキャスト、顔が一つも映らない画面収録。

速いスポーツは作業が続いている領域ですが、すでに効いている点を正確に述べる価値があります。試合の引きの画こそ、中央切り抜きが最もひどく失敗する場面です。プレーがサイドへ流れた時点で、切り抜きはその部分をすでに捨てています。ここでは動きを保てる広さを維持し、画面の中央ではなく動きそのものに合わせます。まだできていないのは、一つの連続した画の内側でプレーを追うこと、つまりカメラマンがすることです。リフレームの品質は完成する機能ではありません。クリッピングのツールにとってはそれが勝負そのものなので、作業は続きます。今どこまで来ているかを知りたければ、動画を1本通して、各瞬間をどう切るか見てください。

よくある質問

なぜ全部を中央で切らないのですか。

寄りの画では機能し、それ以外では失敗するからです。引きの画を中央で切ると、そのショットが存在した理由の部分が消えます。選んだ瞬間が正しくても自動クリップが壊れて見える、最も多い原因がこれです。

なぜ全部をレターボックスにしないのですか。

何も失われませんが、すべてが小さくなります。帯だらけの一本は「動画の動画」に見えます。レターボックスはタイトルカードには正解で会話には不正解であり、だからこそクリップ全体に一度だけ決められないのです。

選ばれた構図を直せますか。

はい、シーン単位で。エディタでは他のシーンに触れずに1つのショットの構図を決められ、その選択はプレビュー限りの見かけではなく、書き出しまで残ります。

画面に人がいない場合も機能しますか。

素朴な検出器が壊れるのがその場合なので、明示的に扱っています。人のいない画面収録や素材映像は、存在しない顔ではなく、その内容に合わせて構図が決まります。

速いスポーツにはどう対応しますか。

プレーを画面内に保ちます。これは中央切り抜きにはできないことで、引きの画では動きが移った先の部分がまさに切り落とされます。まだできていないのは、一つの連続した画の内側でカメラマンのようにプレーを追うことです。そのため、切れ目のない長い場面は追尾ではなく構図で処理されます。そこは今も作業中であり、試合で気づかれるより先に申し上げます。

一つのモデルがすべて決めているのですか。

いいえ。顔と人物の検出、カット検出、話者分離、音声が、それらを崩す素材に対して調整された規則を動かしています。進歩の大半は成功ではなく失敗から来ています。

ご自身の素材で構図を見てください

面白い試験は正面のトーク映像ではありません。引きの画、タイトルカード、複数人が入ったものを渡して、枠がどこへ行くか見てください。