自由な転写 英語
人工知能で 英語 のオーディオとビデオをテキストに変換します。高速で正確で無料です。
どうやって働くのか
- 次のページに移動 Free.aiトランスクリプタ
- 英語 音声またはビデオファイルをアップロード
- 人工知能は自動的に 英語を検出し 転写する
- テキストまたは SRT 字幕として転写をダウンロードします
英語 転写機能
- ✓faster-whisper によって提供 (MIT ライセンス)
- ✓自動 英語 言語検出
- ✓MP3、WAV、MP4、M4A、FLACなどをサポート
- ✓タイムスタンプと字幕エクスポート (SRT)
- ✓有料プランではファイルサイズ制限なし
- ✓プライベートでセキュリティの高い -- ファイルは処理後に削除されます
言語の詳細
| 言語 | 英語 |
| ISOコード | en |
| AIモデル | faster-whisper |
| プライス | フリー |
その他の言語
すべての言語を表示よくある質問
Whisper large-v3-turboは英語の最高精度レベルに達し、標準ベンチマークでは7%以下のワードエラー率を示しました。実際には、クリーンなスタジオオーディオはほぼ完璧に戻り、会話オーディオは最小限のクリーニングで使用可能です。(ベンチマークセットにおける階層A,under 7% word error rate - マーケティングクレジットではなく、正直なWER階層を公開する)
はい - 英語 転写は、まず、あなたの日々のフリートークンプールから引く。オーディオは、1 分あたり 50 トークンかかります。匿名の日々のプールは、1 日に数時間のオーディオをカバーします。ログインしたアカウントは、より大きな 30,000 トークンの日々のプールを得ます。それ以外の転写は、$1 からのトークン充填で、使用分のみ支払います。
English transcription covers US, UK, Australian, Indian, and other major accents in one model. Whisper was trained on all of them and the transcript comes out in standard English spelling regardless of the speaker's accent.
MP3、WAV、M4A、FLAC、OGG、OPUS、WEBM は直接受け入れられます。ビデオ (MP4、MOV、MKV) の場合、サーバ側でオーディオトラックを抽出して Whisper に送信します。自分で変換する必要はありません。英語 を含むソース言語に関係なく同じパイプラインです。
匿名アップロードの上限はファイルごとに約 500 MB です。ログインしたアカウントは最大 2 GB までです。長さは制限されません。長いファイルは自動的にチャンクされます(30 秒のウィンドウが重なり合い、連続したタイムスタンプを持つ単一の記録に再編集されます)。数時間の 英語 録音(ポッドキャスト、講義全体、会議)は大丈夫です。
はい - すべての 英語 トランスクリプトに対してデフォルトでスピーカーダイアリゼーションが有効です。出力はタイムスタンプを付けてスピーカー 1 / スピーカー 2 / スピーカー 3 に分割されます。インタビュー、パネル討論、多人数の会議はラベル付きで返されます。ダイアリゼーションは別のモデルで実行され、我々がサポートするすべての言語で同じように動作します。
はい - URL を YouTube の場合 /transcribe/youtube/ に、ポッドキャストの場合 /transcribe/podcast/ に貼り付けます。オーディオをダウンロードし、 language=en で Whisper を実行し、タイムスタンプとスピーカーラベルを含む転写を返します。典型的な 英語 コンテンツは 講義やインタビュー、ボイスメモ、YouTubeのコンテンツは 英語で全て動作します URLを /transcribe/youtube/に貼り付けるか、直接ファイルをアップロードします です。
Whisperは音声の1分あたり50トークンを費やします。1時間の録音は約3,000トークンです。 多くのユーザは何も使いません。30,000トークンの無料の日々のプールは短いクリップ、ボイスメモ、一度のポッドキャストをカバーします。それ以外の転写は使用分のみ支払い、トークンは$1から充電できます。
はい - セグメントレベル (10-30秒ごと) とワードレベルのタイムスタンプが使用できます。ワードレベルは VTT/SRT 字幕エクスポートのデフォルトですので、キャプションは行ごとに同期されます。API では、要求のボディに timestamps="word" を設定します。英語 の転写は、言語の正規綴りの標準UTF-8で返されます。
音声 (multipart/form-data, フィールド名 "file") を /v1/transcribe/ に language=en で POST します。または Whisper が自動検出するように言語パラメータを省略します。 JSON に転写、セグメント、タイムスタンプ、スピーカーラベルを返します。 /api/ に完全な参照と SDK スニペットがあります。
翻訳が完了したら、翻訳をクリックし、テキストを /translate/ に貼り付けます。英語 は他の言語 (200 以上) とペアリングします。会議録の場合は /summarize/ に転写を送ります。ダビングの場合は /voice/tts/ に送ります。目的言語の音声を再生します。
Whisperは680K時間のノイズのある実世界音声で訓練され、英語の転写は背景ノイズ、音楽ベッド、電話の質の録音に対して強力です。トランスクリプトが使えなくなった場合は、ファイルとともに contact@free.ai にメールしてください。トークンを返金し、他のエンジンが音声をよりよく処理できるかを調べます。