人工唇同期

商用OK 581 models 透かしなし 登録なし
モデル:
+ GPT-5, Claude, Gemini
話し頭のビデオとオーディオトラックまたはスクリプトをアップロードしてください。新しいオーディオに合わせてフレームごとに口を再レンダリングします。プレミアムリップシンクモデルで動作し、購入したトークンでビデオの秒単位で価格を決めます。リダビング、ADR、ボイスオーバーの置き換え、サイレントクリップの話しをするのに最適です。

動画をここにドラッグまたはクリック

MP4/MOV/WebM ·最大100MB

- · - · -

音声ファイルをここにドラッグまたはクリック

MP3/WAV/M4A ·最大50MB

- · -
0 / 1500
持続時間が一致しません
クリップのトークン推定
-
動画と音声をアップロードして(あるいはスクリプトを入力して)正確なコストを見てください。
ダウンロード

AIリップシンクが 稼ぐ場所

『アドバンスド・アドベンチャー』

口の部分を再録音して 口の部分を再現する これ以上 発音の間違いで 再撮影は無い

声優交換

どんな俳優でも撮影し、好きなボイスオーバーアーティスト(またはTTS音声)でダビングしてください。口は先導ではなく、後続します。

話し言葉のアバター

静止画やAIキャラクターに声を付けます。 /image-to-video/ とチェーンすると、静止画をアニメーション化し、その後話しかけます。

AIリップシンクの仕組み

ステップ1

動画をアップロード

明瞭な前方向の顔が最も効果的です。マルチスピーカー、プロファイルビュー、急速な頭の回転は品質を低下させます。

ステップ2

オーディオを提供

MP3/WAV/M4Aをアップロードするか、スクリプトを入力して、Kokoro(37言語にわたる174の音声)でTTSします。

ステップ 3

チェック

音声と映像が0.5秒以上異なると警告します。自動的に短い長さにトリムするのはデフォルトでチェックされています。

ステップ4

レンダリング

プレミアムリップシンクモデルは、新しい音声に音声的に一致するように、すべての口フレームを再レンダリングします。典型的な30秒のクリップは、約1-2分です。

唇同期出力のためのヒント

  • 前方に向かってるスピーカーが 顔検出器を混乱させる
  • 顔の半分が暗く 口の追跡が困難だ
  • オーディオはピーク -6 dB から -3 dB で、クリップされたオーディオやウィスパー・サイレントなオーディオの同期は悪い。
  • 30秒のチャンクが最も速くレンダリングされます。10分以上のビデオの場合はシーンに分割してください。
詳細オプション
結果
トークンが足りない もっとトークンを取得
もっと良い結果が欲しいのか? プレミアムモデル (GPT-5, Claude, Gemini) deliver higher quality. プランを表示

❤️ Love Free.ai? Tell your friends!

登録 推薦リンクを得る 友達1人当たり30,000トークンを得る

もっと欲しい? Sign up free: 30,000 tokens/day
無料登録

要求を処理中...

AIで唇同期ビデオを作成します。どんな顔にも音声を合わせます。

使い方 人工唇同期

1
入力を入力

テキストを入力し、ファイルをアップロードし、または要望を記述します。アカウントは必要ありません。

2
クリックして生成

私たちのAIは、最良のオープンソースモデルを使って、数秒であなたの要求を処理します。

3
ダウンロードと共有

結果をダウンロード、コピー、共有できます。個人的、商業的な使用は無料です。

API を使ってこのツールを使用

あなたのコードからこのツールを自動化します。OpenAI 互換の REST エンドポイント、ベアートークン認証、追加の SDK が必要ありません。トークンコストはウェブインターフェースと一致します。

curl -X POST https://api.free.ai/v1/video/generate/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"prompt": "A cat playing piano", "duration": 4}'

人工唇同期 - FAQ

話し頭のビデオとオーディオトラックをアップロードすると、AI はフレームごとに口を再レンダリングして、新しいオーディオと音声的に一致させます。ADR、ボイスオーバーの置き換え、リダビング、無声の肖像画に声を与えるのに最適です。

プレミアム口のレンダリングモデルがその仕事をします。音声の各音素を分析し、各フレームで顔を検出し、唇領域をマッチさせて再生します。顔、背景、体の残りは手を加えません。

いいえ。リップシンクはビデオの秒単位で請求されるプレミアムモデルで動作します。購入したトークンだけを使用します。登録ボーナスや日々のプールトークンはカバーしません。価格はクリップの長さに応じてスケールされ、提出する前に表示されます。

MP4、MOV、WebM 100MBまで。30秒以下のクリップが最も速く動作します。1 つの前方スピーカーは最もクリーンなリップシンクロを提供します。複数のスピーカーや急速な頭の回転は品質を低下させます。

音声ファイルを MP3、WAV、M4A で 50MBまで 変換できます。 もしくは、スクリプトを入力して Kokoro の 37 言語に渡る 174 の音声から選択してください。

持続時間が 0.5 秒以上違うと警告します。自動的に短く切り替えるトグル (標準で有効) は、長いものを切り替えます。そうでなければ、出力は重なり合うウィンドウのみをカバーします。

良い結果: 1 人の明瞭な前方向顔、良い照明、ほとんど安定したカメラ。悪い結果: プロファイルビュー、遮蔽された顔(サングラス、マスク)、複数の競合する顔、フレーム中の部分的な口を持つ極端なクローズアップ。

ダビング (/video/dubbing/) は STT → translate → TTS → lip-sync のパイプラインです。リップシンクは最後のステップに過ぎません。音声を自分で提供します。ボイスオーバートラックが準備できたら lip-sync を使い、翻訳と再生を初めて行うときは dubbing を使います。

典型的な場合: 30 秒のクリップは 1-2 分でレンダリングされます。提出後、バナーは待ち時間の推定値を表示し、結果はダッシュボードに表示されます。タブを閉じることができます。

一度のパスでなく、モデルは一つの顔にロックされます。マルチスピーカーシーンでは、単一スピーカークリップに切り分け、それぞれをリップシンクし、ビデオエディタで再び合わせます。

入力ファイルはレンダリング後数分以内に削除されます。出力は共有リンクの CDN 上で 24 時間 (有料ユーザは 7 日) 保存されます。

はい - 複数のビデオとオーディオファイル (またはビデオとテキストと音声) を /v1/video/lip-sync/ に POST します。ドキュメントは /api/ を参照してください。

Sign up free: 30,000 tokens/day

無料アカウントを作成

クレジットカードは必要ありません

このツールを評価するには?

Love Free.ai? Tell your friends!