Kling 3.0 Omniでショートドラマを絵コンテ化:リップシンクとマルチショットを一度に
多くのAIショートドラマ絵コンテチュートリアルは、どのモデルも同じように扱う——ショットごとに1つのプロンプトを書き、生成し、そのままハードカットでつなぐ。Kling 3.0 Omniはドラマにとって重要な2点でこの前提を覆す。1回の生成内で複数ショットを計画でき、ネイティブでリップシンク済みのセリフを生成できる点だ。本ガイドは汎用的な絵コンテ解説ではなく、Omniだけが持つこの2つの能力と、それを軸にした絵コンテの組み方を扱う——素人っぽいAIドラマを見抜かれる「継ぎ目」を消すためだ。
AIエピソードの絵コンテを組んだことがない方は、まずモデルに依存しない基礎を読んでほしい:ショートフィルムの絵コンテの作り方。
Kling 3.0 Omniは絵コンテにおいて何が違うのか?
Kling 3.0 Omniが違うのは、他のモデルでは別々のツールに分かれている2つの仕事——マルチショット計画と音声・リップシンク——を1つに統合している点だ。2026年2月4日にKuaishouがリリースしたOmniモデルは、ネイティブ4Kで最長15秒のクリップを生成でき、内蔵の「AI Director」により1回の生成で最大6つの異なるショットを含めることができる——それぞれ独自の長さ、ショットサイズ、カメラアングルを持ちながら、キャラクターと空間の連続性を自動的に維持する。詳細は公式Kling Video 3.0 Omniユーザーガイドを参照。
さらにOmniは、統一モデル内でネイティブ音声生成と自動リップシンクを英語・中国語・日本語・韓国語・スペイン語の5言語に対応させている。詳しくはVidmuse社のKling 3.0 Omniガイドを参照。ショートドラマにとって、この2つの機能はまさにAIエピソードが崩れがちな箇所を直撃する。
実践ルール: Kling 3.0 Omniを単一ショットモデルのように絵コンテしてはいけない。その生成単位は1ショットではなく、最大6ショットのミニシーンだ——クリップ単位ではなく、シーン単位で計画すること。
なぜショット長よりも継ぎ目が重要なのか?
ドラマを変えるアップグレードはクリップの長さではなく、つなぎ目の少なさだ。ショートドラマ1話は60〜120秒のマルチショット構成であり、15秒の上限があっても1話全体をカバーできるわけではない。この上限が実際に変えるのは継ぎ目の密度だ。
告白、平手打ち、正体の暴露といった感情のビートは、通常15〜30秒の連続したアクションだ。モデルが一度に短いショット1つしか生成できない場合、そのビートを2つ、3つの別々の生成に分割してハードカットでつなぐことになる。継ぎ目のたびに、光が飛び、髪型がリセットされ、部屋の残響が途切れ、衣装の色味がずれる。視聴者は何が悪いのか言葉にできないが、そのシーンを信じなくなる。
実践ルール: 単一ショット制限の単位は秒数ではなく、1分あたりの物語の継ぎ目の数だ。マルチショット生成なら、感情のビート全体を1回の連続レンダリング内に収められる。
OmniのAI Directorは1回の生成で最大6ショットにわたり連続性を維持できるため、継ぎ目が命取りになる場所——感情のビート全体を、継ぎ目なしに保つことができる。
Kling 3.0 Omni向けの絵コンテの作り方:ステップバイステップ
Omni向けに絵コンテを組むには、ショットリストを連続性を共有する最大6ショットのビートにグループ化し、ショットごとに1プロンプトではなく、ビートごとに1回のAI Director生成を書く。以下が実際のループだ:
- エピソードを感情のビートに分割する。 90秒のエピソードは通常4〜6ビート(導入、エスカレーション、転換、頂点、解決)。各ビートが1回のOmni生成に対応する。
- 最も長く連続した生成を、最も重いビートに割り当てる。 頂点——告白や暴露——には単一のマルチショットレンダリングを充て、感情の真っ只中に継ぎ目が入らないようにする。
- ビート内でAI Directorのショットカードを書く。 最大6ショットそれぞれについてショットサイズ、カメラアングル、アクションを指定し、Omniにその間の空間的連続性を維持させる。
- セリフのビートにはキャラクターボイスを紐付ける。 Omniのキャラクターボイスバインディングとネイティブリップシンクを使い、セリフを後付けで同期させるのではなく、生成時点で同期させる。
- ハードカットはビートの境界のみに留める。 ビート間(シーンチェンジが継ぎ目を隠してくれる箇所)でのみカットし、頂点ビートの内部では絶対にカットしない。
- 市場ごとにリップシンクをローカライズする。 Omniの5言語リップシンクにより、同一の絵コンテから英語・中国語・日本語・韓国語・スペイン語のセリフバージョンを制作できる。
まずAI絵コンテジェネレーターでビートごとの計画を下書きし、各ビートをOmniに1回のAI Director生成として持ち込む。
ネイティブリップシンクはセリフシーンをどう変えるのか?
ネイティブリップシンクは、AIドラマ制作で最も脆弱なポストプロダクション工程を取り除く。従来は話しているショットを生成し、別のリップシンクツールで口の動きを音声トラックに無理やり合わせる——この2段階プロセスは、ゴムのような、微妙にずれた口元を生みがちで、それが偽物っぽさとして見抜かれる。Omniはセリフと対応する口の動きを一度に、同じパスで生成するため、同期は後付けではなく最初から組み込まれている。
連続もののドラマにとって、これはローカライズも解決する。リップシンクがモデル内部で5言語に対応しているため、1つのセリフビートを市場ごとに、正しい口の動きで再生成できる——もう合わなくなった口元に吹き替えを重ねる必要はない。これが「ネイティブ版に見える書き出し」と「吹き替えに見える書き出し」の違いだ。
実践ルール: セリフとリップシンクは順番にではなく、一緒に生成する——ショットと後付け同期パスの間の継ぎ目は、2つのクリップ間の継ぎ目と同じくらい致命的だ。
Kling 3.0 Omniにまだ計画が必要な部分
Omniは全編を作る万能マシンではない。15秒の上限がある以上、1話はビートの境界でつながれた複数の生成で構成される——だからエピソード全体を通じてキャラクターと衣装の一貫性を保つのは、モデルではなくあなたの絵コンテだ。キャラクターリファレンスとボイスバインディングは各生成の内部および生成間で助けになるが、90秒にわたるドリフトを防ぐのは、同じ記述子を全ビートに一貫して持ち込む文書化された絵コンテという規律だ。まず絵コンテ、その後に生成——このモデルは構造には報い、即興には罰を与える。
よくある質問
Kling 3.0 Omniは自動でリップシンクを行いますか? はい。Omniは1つの統一モデル内でネイティブ音声を生成し、英語・中国語・日本語・韓国語・スペイン語で自動リップシンクを行い、別途のポストプロダクション同期工程を不要にします。
Kling 3.0 Omniは1クリップで何ショットまで生成できますか? 最長15秒の1回の生成内で最大6つの異なるショットを生成でき、それぞれ独自の長さ、ショットサイズ、カメラアングルを持ち、内蔵のAI Directorが連続性を維持します。
Kling 3.0 Omniの1回の生成でショートドラマ1話をまるごと作れますか? いいえ。1話は60〜120秒なので、複数のマルチショット生成を作成し、ビートの境界でカットしてつなぐ必要があります。Omniの価値は各感情ビートを継ぎ目なく保つことであり、エピソード全体を一度にレンダリングすることではありません。
Kling 3.0 OmniはSoraやSeedanceと絵コンテの面でどう違いますか? そのマルチショットAI Directorとネイティブな多言語リップシンクは1つのモデルに組み込まれているため、ショットごとに絵コンテを組んで音声を別途同期させるのではなく、ビート単位で絵コンテを組み、同期済みのセリフを一度に生成できます。
どのビートに最長の連続レンダリングを割り当てるべきですか? 最も重い感情の頂点——告白、平手打ち、正体の暴露——目に見える継ぎ目が視聴者の没入を壊してしまう箇所です。設定を示すワイドショットには、コストの低い継ぎ目を任せましょう。
ビート単位でエピソードの絵コンテを組む準備はできましたか?AI絵コンテジェネレーターでショットプランを始め、頂点ビートを継ぎ目なく保ちましょう。
DramaSo Team