自由な転写 アゼルバイジャン語

人工知能で アゼルバイジャン語 のオーディオとビデオをテキストに変換します。高速で正確で無料です。

どうやって働くのか

  1. 次のページに移動 Free.aiトランスクリプタ
  2. アゼルバイジャン語 音声またはビデオファイルをアップロード
  3. 人工知能は自動的に アゼルバイジャン語を検出し 転写する
  4. テキストまたは SRT 字幕として転写をダウンロードします

アゼルバイジャン語 転写機能

  • ✓faster-whisper によって提供 (MIT ライセンス)
  • ✓自動 アゼルバイジャン語 言語検出
  • ✓MP3、WAV、MP4、M4A、FLACなどをサポート
  • ✓タイムスタンプと字幕エクスポート (SRT)
  • ✓有料プランではファイルサイズ制限なし
  • ✓プライベートでセキュリティの高い -- ファイルは処理後に削除されます

言語の詳細

言語アゼルバイジャン語
ISOコードaz
AIモデルfaster-whisper
プライスフリー

その他の言語

すべての言語を表示

よくある質問

アゼルバイジャン語 は Whisper のためのリソースの少ない言語です - large-v3-turbo は 25% の単語誤り率を超え、時にはかなり超えます。 転写は検索と gist に役立ちますが、公開準備済みとは扱わないでください。 アゼルバイジャン語 のためのより高精度なエンジンが利用可能になれば、自動的にそれをワイヤーインします。(ベンチマークセットにおける階層D,over 25% word error rate - マーケティングクレジットではなく、正直なWER階層を公開する)

はい - アゼルバイジャン語 転写は、まず、あなたの日々のフリートークンプールから引く。オーディオは、1 分あたり 50 トークンかかります。匿名の日々のプールは、1 日に数時間のオーディオをカバーします。ログインしたアカウントは、より大きな 30,000 トークンの日々のプールを得ます。それ以外の転写は、$1 からのトークン充填で、使用分のみ支払います。

アゼルバイジャン語 の転写は、言語の正規綴りの標準UTF-8で返されます。

MP3、WAV、M4A、FLAC、OGG、OPUS、WEBM は直接受け入れられます。ビデオ (MP4、MOV、MKV) の場合、サーバ側でオーディオトラックを抽出して Whisper に送信します。自分で変換する必要はありません。アゼルバイジャン語 を含むソース言語に関係なく同じパイプラインです。

匿名アップロードの上限はファイルごとに約 500 MB です。ログインしたアカウントは最大 2 GB までです。長さは制限されません。長いファイルは自動的にチャンクされます(30 秒のウィンドウが重なり合い、連続したタイムスタンプを持つ単一の記録に再編集されます)。数時間の アゼルバイジャン語 録音(ポッドキャスト、講義全体、会議)は大丈夫です。

はい - すべての アゼルバイジャン語 トランスクリプトに対してデフォルトでスピーカーダイアリゼーションが有効です。出力はタイムスタンプを付けてスピーカー 1 / スピーカー 2 / スピーカー 3 に分割されます。インタビュー、パネル討論、多人数の会議はラベル付きで返されます。ダイアリゼーションは別のモデルで実行され、我々がサポートするすべての言語で同じように動作します。

はい - URL を YouTube の場合 /transcribe/youtube/ に、ポッドキャストの場合 /transcribe/podcast/ に貼り付けます。オーディオをダウンロードし、 language=az で Whisper を実行し、タイムスタンプとスピーカーラベルを含む転写を返します。典型的な アゼルバイジャン語 コンテンツは 講義やインタビュー、ボイスメモ、YouTubeのコンテンツは アゼルバイジャン語で全て動作します URLを /transcribe/youtube/に貼り付けるか、直接ファイルをアップロードします です。

Whisperは音声の1分あたり50トークンを費やします。1時間の録音は約3,000トークンです。 多くのユーザは何も使いません。30,000トークンの無料の日々のプールは短いクリップ、ボイスメモ、一度のポッドキャストをカバーします。それ以外の転写は使用分のみ支払い、トークンは$1から充電できます。

はい - セグメントレベル (10-30秒ごと) とワードレベルのタイムスタンプが使用できます。ワードレベルは VTT/SRT 字幕エクスポートのデフォルトですので、キャプションは行ごとに同期されます。API では、要求のボディに timestamps="word" を設定します。アゼルバイジャン語 の転写は、言語の正規綴りの標準UTF-8で返されます。

音声 (multipart/form-data, フィールド名 "file") を /v1/transcribe/ に language=az で POST します。または Whisper が自動検出するように言語パラメータを省略します。 JSON に転写、セグメント、タイムスタンプ、スピーカーラベルを返します。 /api/ に完全な参照と SDK スニペットがあります。

翻訳が完了したら、翻訳をクリックし、テキストを /translate/ に貼り付けます。アゼルバイジャン語 は他の言語 (200 以上) とペアリングします。会議録の場合は /summarize/ に転写を送ります。ダビングの場合は /voice/tts/ に送ります。目的言語の音声を再生します。

Whisper のノイズ訓練はこのレベルでは役に立ちません。ボトルネックは訓練中に アゼルバイジャン語 音声 Whisper が見た音量で、ノイズではありません。クリーンスタジオオーディオはノイズオーディオを打ち負かしますが、高リソース言語で得られる精度には達しません。トランスクリプトが使えなくなった場合は、ファイルとともに contact@free.ai にメールしてください。トークンを返金し、他のエンジンが音声をよりよく処理できるかを調べます。

Love Free.ai? Tell your friends!

このページを評価