ポッドキャスト転写

商用OK 581 models 透かしなし 登録なし
モデル:
+ GPT-5, Claude, Gemini
ポッドキャストエピソードをアップロードし、静寂ギャップから自動検出された章マーカーを備えた清潔な、スピーカーラベル付きのトランスクリプトを取得します。長いファイルは最大2GB、99言語、Whisper-large-v3精度です。ビデオポッドキャストのための SRT/VTT としてエクスポート、ショーノートのための単純な TXT または Descript スタイルのワークフローで編集する JSON として。

ポッドキャストエピソードをドラッグ&ドロップするか、クリックしてブラウズします

MP3、WAV、M4A、OGG、MP4 — ロングフォームエピソードは2GBまで

- - - -
クライアント側でセグメント間隔からチャプターマーカーを計算し、トランスクリプトに付け加えます。YouTube や Spotify の説明にそのまま貼り付けます。
このクリップのトークン推定
-
ポッドキャスト
自動検出章

ポッドキャストを転写中...

長いエピソードは数分かかります。完了時にメールを送信するオプションをチェックすると、このタブを閉じることができます。

ポッドキャストの編集者と番組編集者のために作られた

メモを一つの貼り付けで表示

話をアップロードし、TXTをダウンロードします。 話者のラベルをインラインに、 Spotify/YouTubeの説明に準備した章タイムスタンプ、ブログのポストを4時間ではなく10分で書く。

ポッドキャスト字幕

スピーカーラベルを含む SRT または WebVTT をエクスポートします。 Premiere、Final Cut、DaVinci Resolve に直接ドラッグしてください。または YouTube のビデオと一緒にアップロードして、清潔なキャプションを作成してください。

テキストベースのエピソード編集

JSON エクスポートは、開始/終了タイムスタンプを含む全ての単語を返します。Descript、Reaper、またはカスタムワークフローにパイプします。スクラビングではなくテキストをハイライトして編集します。

ポッドキャスト転写の仕組み

  1. ドラッグゾーンにエピソードをドラッグします。MP3、WAV、M4A、MP4、最大2GB。
  2. プレゼンターラベルと章マーカーをオンにしておく (デフォルト)。出力フォーマットを選択します。
  3. 時間を確認し 値段を上げます トークンを使う前に 転写をクリックしてください
  4. 音声ファイルをダウンロードします。

Free.aiポッドキャストの記録と デスクリプト、リバーサイド、オッター

特徴 Free.ai Descript Riverside Otter.ai
プライスPay-per-use ($0.003/min)$15-30/mo$19/mo$16.99/mo
最大ファイルサイズ2 GB5 GBTied to record session500 MB (varies)
話者のダイアリズム
自動章マーカー あなたは 私のことを どう思うでしょう?Manual-Paid tier
SRT/VTTエクスポートPaid
言語9922100+English-focused
パブリックAPI--Limited
競合他社の価格は2026年の公開リストの階層を反映しています。現在のプランについては各プロバイダを確認してください。
詳細オプション
結果
トークンが足りない もっとトークンを取得
もっと良い結果が欲しいのか? プレミアムモデル (GPT-5, Claude, Gemini) deliver higher quality. プランを表示

❤️ Love Free.ai? Tell your friends!

登録 推薦リンクを得る 友達1人当たり30,000トークンを得る

もっと欲しい? Sign up free: 30,000 tokens/day
無料登録

要求を処理中...

AIでポッドキャストをテキストに無料で転写。スピーカーラベル、章マーカー、SRTエクスポート。

使い方 ポッドキャスト転写

1
入力を入力

テキストを入力し、ファイルをアップロードし、または要望を記述します。アカウントは必要ありません。

2
クリックして生成

私たちのAIは、最良のオープンソースモデルを使って、数秒であなたの要求を処理します。

3
ダウンロードと共有

結果をダウンロード、コピー、共有できます。個人的、商業的な使用は無料です。

API を使ってこのツールを使用

あなたのコードからこのツールを自動化します。OpenAI 互換の REST エンドポイント、ベアートークン認証、追加の SDK が必要ありません。トークンコストはウェブインターフェースと一致します。

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"file": "@audio.mp3", "language": "auto"}'

ポッドキャスト転写 - FAQ

The podcast tool defaults to speaker diarization and chapter markers (silence-gap detection >2s), and supports long-form files up to 2GB. Output formats include SRT + VTT for show-notes video clips, plain TXT for blog posts, and structured JSON with per-turn timestamps + speaker labels for editing in Descript-style workflows.

ファイルごとに最大2GB - 128kbps MP3で約14時間のオーディオポッドキャストです。長いファイルはサーバ側でチャンクされます。一つの合成されたトランスクリプトを返します。

はい。デフォルトではスピーカーダイアリゼーションがオンです。ECAPA の音声埋め込みを通して 2-10 個の異なる音声を検出し、スピーカー 1 / 2 /... とラベルを付け、それらを各セグメントに適用します。結果ビューで名前を変更できます。

2 秒以上の静寂間隔 - ポッドキャストのセグメント間の自然な休止。各章はタイムスタンプを持ち、YouTube + Spotify の "Chapters:" ブロックでショーノートに直接貼り付けることができます。

10時間の転写につき、Descriptはエディタに結びつけて月額15-30ドルを請求します。Whisperでは、使用時に500トークン/分で請求します。(5ドル=200Kトークン=400分)サブスクリプションはありません。どこにでも貼り付けられる単純なエクスポートです。

Riversideは、アプリ内で自分のセッションを無料で転写するレコーディングスタジオです。しかし、彼らと録音した後のみです。どのMP3/WAV/MP4も、録音場所に関係なく転写します。

Otterは無料の段階で月間300分の制限があり、英語に焦点を当てています。99の言語を同じWhisper-large-v3の精度でサポートしており、月間制限はありません。

出力フォーマットとして SRT または WebVTT を選択します。スピーカーラベルはインライン (SRT) または <v Speaker N> タグ (VTT) として含まれ、ほとんどの現代のプレーヤーで正しく表示されます。

Whisper-large-v3は音楽ベッドや軽い残響をうまく扱います(典型的なワードエラー率は3-7%)。 非常に大きな音楽や重い重なりは正確性を低下させます。コピー上で /music/vocal-remover/ を先に実行したり、コールドオープンを分割したりしてみてください。

Whisper handles most common names, but highly brand-specific jargon may need a post-edit pass. A ~30-minute episode typically has 5-10 brand/name corrections to apply manually.

ここで一度に一つずつアップロードするか、ログインしたら /batch/ 機能を使ってシーズンをキューに入れます。 /api/ の API はプログラミング的なバッチングのために POST /v1/stt/ も受け入れます。

いいえ。アップロードされたファイルは転写が完了した後に削除されます。転写はログインした場合、/account/の履歴にダウンロードされます。匿名ユーザは 24 時間の共有リンクを受け取ります。

Sign up free: 30,000 tokens/day

無料アカウントを作成

クレジットカードは必要ありません

このツールを評価するには?

Love Free.ai? Tell your friends!