人工知能ビデオ翻訳

商用OK 380+モデル 透かしなし 登録は不要
モデル:
+ GPT-5, Claude, Gemini
Repost your YouTube in Spanish, Hindi, French — with your face actually saying the words. Upload a video, pick a target language + voice, and we transcribe, translate, re-voice, and mix the new audio back into the original clip. Toggle lip-sync to also re-render the mouth.

動画をここにドラッグ&ドロップするか、クリックしてブラウズします

MP4、MOV、WebM 100MBまで · 5分以下のクリップが最も速く動作します

· ·
動画は1分あたり約1500トークン(オーディオパス)、リップシンクは約3000トークン/分。
動画からオーディオを抽出中...
翻訳済みビデオ
Show transcript + translation
原文(転写)

                    
翻訳

                    
ダウンロード MP4

映像翻訳機の利点

YouTubeのリポスト

英語1つアップロード→スペイン語、ヒンディー語、フランス語、ポルトガル語、インドネシア語各言語の話者の声で再アップロード。1つのプロダクションの視聴者数の4倍。

コースをローカライズ

50ビデオの授業を 10言語に 翻訳するのは 夜中に終わる

広告のロカライズ

10カ国のアカウントで同じ製品紹介を実行します。同じ俳優、同じショット、市場ごとのネイティブ音声。再撮影なし。

動画翻訳機の動作

ステップ 1

オーディオを抽出

サーバ側の ffmpeg はアップロードした MP3 をクリーンに取得します。高速 — API VPS 上で実行します。

ステップ 2

転写

Whisperは、自動的な言語検出で音声をテキストに変換します。99の言語をサポートします。

ステップ 3

Translate + re-voice

MadLADは目標言語に翻訳し、Kokoroは174のオプションから選択した声でそれを返す。

ステップ 4

Mix back + (optional) lip-sync

ffmpeg は元のオーディオを新しいトラックに置き換えます。リップシンクが有効なら、Sync Lipsync v2 は口をマッチさせて再レンダリングします。

翻訳ビデオのクリーン化のためのヒント

  • 前向きのスピーカーが一人 複数のスピーカーがいるシーンは 記録とリップシンクロの両方を混乱させる
  • 音声は -6 dB でクリアです。背景音楽やノイズは転写の正確性を低下させます。
  • 5分以下のクリップは2〜5分(オーディオパス)または5〜15分(リップシンク)でレンダリングする。
  • スペイン語、フランス語、ドイツ語、ポルトガル語、イタリア語は最も自然なココロ音声オプションです。ヒンディー語、アラビア語、日本語、韓国語、中国語も動作します。
追加オプション
結果
証券が足りない もっとトークンを取得
もっと良い結果が欲しいのか? プレミアムモデル また,高品質の画像を得るためには,画像の解像度を高くする必要がある。 プランを表示

❤️ Love this tool? Share it!

紹介リンクを得て 友達1人につき25,000トークンを稼ぐために

もっと欲しい? 無料登録で1日30Kトークン+10Kボーナス
無料登録

ご要望を処理中...

スペイン語、ヒンディー語、フランス語でYouTubeを再投稿します。発話者の声は目的言語になります。Whisperが転写し、MadLADが翻訳し、Kokoroが再録音し、ffmpegが再ミックスします。オプションのSync Lipsync v2は口を再レンダリングします。

使い方 人工知能ビデオ翻訳

1
入力を入力

テキストを入力、ファイルをアップロード、または必要なことを記述します。アカウントは必要ありません。

2
クリックして生成

私たちのAIは、最良のオープンソースモデルを使って、あなたの要求を数秒で処理します。

3
ダウンロードと共有

結果をダウンロード、コピー、共有できます。個人的、商業的な使用は無料です。

このツールを API で使用

あなたのコードからこのツールを自動化します。OpenAI 互換の REST エンドポイント、ベアートークン認証、追加の SDK が必要ありません。トークンのコストはウェブインターフェースと一致します。

curl -X POST https://api.free.ai/v1/video/generate/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"prompt": "A cat playing piano", "duration": 4}'

人工知能ビデオ翻訳 — FAQ

あらゆるビデオ(YouTubeクリップ、授業講義、製品評価)をアップロードして、その言語で再合成された話者の声を含む目標言語への翻訳を行います。オプションとして、リップシンクは、新しいオーディオに合致するように口を再レンダリングします。ピッチ:YouTubeをスペイン語、ヒンディー語、フランス語で再投稿します。あなたの顔が実際に言葉を言うようになります。

クライアント側では次の5段階が順次実行されます。 (1) ffmpeg はビデオからクリアな MP3 を抽出します。 (2) Whisper はそれを転写します(99 言語を自動検出します)。 (3) MadLAD はテキストを翻訳します。 (4) Kokoro は翻訳をあなたが選択した音声で話します。 (5) ffmpeg は新しいオーディオを元のビデオに戻し、元のトラックを置き換えます。リップシンクをオンにすると、6 番目のステップは結果を Sync Lipsync v2 を通して口を再レンダリングします。

動画翻訳は、唇同期をオプションにすることができます。これは3倍速く、約50%安く、口調の完全同期が重要でないボイスオーバースタイルのコンテンツに適しています。例えば、ポッドキャスト、スクリーン録音、料理ビデオ、話者が常に近くにいないものなどです。

音声のみのパスはほとんど完全に自己ホストモデル (ffmpeg + Whisper + MadLAD + Kokoro) で実行されますので、短いクリップのための日々のトークン割り当てに収まります。リップシンクはプレミアム Sync Lipsync v2 モデルを使用し、購入したトークンが必要です。推定:オーディオパスの場合はビデオの分当たり約 1,500 個のトークン、リップシンクの場合は分当たり約 3,000 個のトークン。

20 の高い要求言語 (スペイン語、フランス語、ドイツ語、イタリア語、ポルトガル語、オランダ語、ポーランド語、ロシア語、トルコ語、アラビア語、ヘブライ語、ヒンディー語、中国語、日本語、韓国語、ベトナム語、インドネシア語、タイ語、スウェーデン語、英語) がドロップダウンで表示されます。 MadLAD は技術的に 450 以上の言語をサポートしています。他の言語が必要なら、私たちに連絡してください。

はい - 音声選択機能は 37 言語の 174 の Kokoro 音声を全て引き出します。それぞれの音声にはサンプルがタグ付けされているので、コミットする前にオーディションを行うことができます。最も自然な結果を得るには、音声の性別を話者に合わせてください。

いいえ、Kokoroは174の標準音声から選択します。オリジナルのスピーカーのクローンではありません。アイデンティティを保持するための音声クローンのためには、まず /voice/clone/ツールを実行してスピーカーの音声を捕捉し、その後カスタムワークフローを使用してください。音声クローンと自動翻訳は1つのパイプラインでロードマップにあります。

100MBまでのクリップはよく処理されます。5分以下の場合はオーディオパスの場合2-5分、リップシンクの場合5-15分でレンダリングします。長いビデオの場合はシーンに分割してそれぞれを翻訳し、/video/editor/に再結合します。

MP4, MOV, WebM, MKV 100MBまで。前方に向けたスピーカーが一つだけあると、最も清潔な転写と (有効にすると) 最も良い唇同期が得られます。背景音楽や複数のスピーカーがある場合は、転写の正確さが低下します。

人工知能ビデオ翻訳ではありません。音声を置き換えます。映像は置き換えません。翻訳された字幕をビデオに書き込むには、結果に /video/caption/ ツールを実行してください。SRT/VTT 字幕ファイルをエクスポートするには、オリジナルのビデオに /transcribe/ を使用してください。

アップロードはレンダリング後数分以内に削除されます。出力は共有リンクに24時間(有料ユーザは7日)保存され、その後削除されます。

単一のエンドポイントではなく、既存のライブのものをチェーン化します。POST /v1/video/to-audio/ → /v1/stt/ → /v1/translate/ → /v1/tts/ → /v1/video/add-audio/、そしてオプションとして /v1/video/lip-sync/。それぞれの完全なカーリングレシピは /api/ にあります。フロントエンドはこのチェーンを正確にオーケストラ化します。

1万枚のトークンで無料登録

無料アカウントを作成

クレジットカードは必要ありません

このツールをどう評価しますか?

Love this tool? Share it!