SadTalker logo

SadTalker

オープンソースの「写真+音声」トーキングヘッド、セルフホスティング可能。

訪問 SadTalker

概要

SadTalkerはAIデジタルアクター&リップシンクツールです。オープンソースの「写真+音声」トーキングヘッド、セルフホスティング可能。

編集部の見解 — 短編ドラマ制作におけるSadTalker

SadTalkerは西安交通大学とTencent AI Labによる、CVPR 2023発表のプロジェクトで、1枚のポートレート写真と音声トラックから、3DMMモーションモデリングを用いてトーキングヘッドを生成する。任意でGFPGANによる顔の高画質化も可能だ。ショートドラマにおける我々の率直な見立てはこうだ——ナレーション挿入カットや様式化されたフラッシュバックの顔には使える古典的な低コストの基礎技術だが、感情的な重みを担うシーンには向かない。

LivePortraitと比べると、SadTalkerは音声駆動型であるのに対し、LivePortraitは演技駆動型だ——演者は不要で音声ファイルさえあればよく、完全合成型のパイプラインに向いている。Apache 2.0ライセンスで完全オフラインの自前ホストが可能な点は、未発表の脚本にとって実質的なプライバシー面での利点になる。ただし大きなアップデートは2023年で止まっており、安定しているが老朽化していると見るべきだ——Syncのような新しいホスト型リップシンクの方がレンダリング品質では上回る。

おすすめの人

オフラインで、単一の写真から音声駆動のトーキングヘッドを、ライセンス費用ゼロで生成したい完全合成型パイプライン向け。

注意点

2023年以降、大きなアップデートは止まっている。出力品質は現行のホスト型リップシンクツールに劣る。

  • 写真と音声からトーキングヘッドを生成
  • 3DMMモーション、GFPGANによる高画質化
  • Apache 2.0ライセンス、完全オフライン対応
  • Stable Diffusion WebUI用の拡張機能を提供

人気とトラフィック

GitHubスター数 ★ 13.9k OpenTalker/SadTalker
最終コミット 2024-06-26 リポジトリの活発度

スター数とコミット日時はGitHubの公開APIから取得しており、更新日は 2026-07-07 です。

カテゴリデジタルアクター
料金無料
縦型 9:16
公式サイトgithub.com

短編ドラマ制作者の使い方

画面上のキャラクターを作成・駆動したり、新しい言語への吹き替えで実写俳優の口を再合成するのに使う。

よくある質問

SadTalkerとは?

SadTalkerはAIデジタルアクター&リップシンクツールです。オープンソースの「写真+音声」トーキングヘッド、セルフホスティング可能。

SadTalkerは無料ですか?

はい、SadTalkerは無料で使えます。

SadTalkerは縦型9:16に対応していますか?

SadTalkerは縦型を主眼にしたツールではないため、9:16対応は公式サイトでご確認ください。

SadTalkerの代替ツールは?

代替ツールには HeyGen、Sync、Synthesia、D-ID などがあります。

SadTalkerの代替ツール

同じ「デジタルアクター」カテゴリの他 15 件

「訪問」をクリックすると、参照タグ付きで公式サイトが開きます。

← すべてのツール