自由な転写 アラビア語

人工知能で アラビア語 のオーディオとビデオをテキストに変換します。高速で正確で無料です。

どうやって働くのか

  1. 次のページに移動 Free.aiトランスクリプタ
  2. アラビア語 音声またはビデオファイルをアップロード
  3. 人工知能は自動的に アラビア語を検出し 転写する
  4. テキストまたは SRT 字幕として転写をダウンロードします

アラビア語 転写機能

  • ✓faster-whisper によって提供 (MIT ライセンス)
  • ✓自動 アラビア語 言語検出
  • ✓MP3、WAV、MP4、M4A、FLACなどをサポート
  • ✓タイムスタンプと字幕エクスポート (SRT)
  • ✓有料プランではファイルサイズ制限なし
  • ✓プライベートでセキュリティの高い -- ファイルは処理後に削除されます

言語の詳細

言語アラビア語
ISOコードar
AIモデルfaster-whisper
プライスフリー

その他の言語

すべての言語を表示

よくある質問

Whisper large-v3-turbo は アラビア語 を十分に扱います。ベンチマーク音声では 7-15% の単語誤り率です。名前付きのエンティティ、数字、密集した技術用語などに時々置換が起こりますが、転写の大部分は正しいでしょう。(ベンチマークセットにおける階層B,7-15% word error rate - マーケティングクレジットではなく、正直なWER階層を公開する)

はい - アラビア語 転写は、まず、あなたの日々のフリートークンプールから引く。オーディオは、1 分あたり 50 トークンかかります。匿名の日々のプールは、1 日に数時間のオーディオをカバーします。ログインしたアカウントは、より大きな 30,000 トークンの日々のプールを得ます。それ以外の転写は、$1 からのトークン充填で、使用分のみ支払います。

アラビア語は標準で Modern Standard Arabic (MSA) レベルで扱われます。エジプト語、レバント語、ガルフ語、マグレビ語の話し言葉は認識されますが、MSA の綴りで転写されます。Whisper はローマ字化もしくは方言特有の綴りを保持しません。純粋な MSA ニュース/講演音声は、Tier-B の正確さを期待してください。重いマグレビ語やエジプト語の話し言葉はそれを低く押します。

MP3、WAV、M4A、FLAC、OGG、OPUS、WEBM は直接受け入れられます。ビデオ (MP4、MOV、MKV) の場合、サーバ側でオーディオトラックを抽出して Whisper に送信します。自分で変換する必要はありません。アラビア語 を含むソース言語に関係なく同じパイプラインです。

匿名アップロードの上限はファイルごとに約 500 MB です。ログインしたアカウントは最大 2 GB までです。長さは制限されません。長いファイルは自動的にチャンクされます(30 秒のウィンドウが重なり合い、連続したタイムスタンプを持つ単一の記録に再編集されます)。数時間の アラビア語 録音(ポッドキャスト、講義全体、会議)は大丈夫です。

はい - すべての アラビア語 トランスクリプトに対してデフォルトでスピーカーダイアリゼーションが有効です。出力はタイムスタンプを付けてスピーカー 1 / スピーカー 2 / スピーカー 3 に分割されます。インタビュー、パネル討論、多人数の会議はラベル付きで返されます。ダイアリゼーションは別のモデルで実行され、我々がサポートするすべての言語で同じように動作します。

はい - URL を YouTube の場合 /transcribe/youtube/ に、ポッドキャストの場合 /transcribe/podcast/ に貼り付けます。オーディオをダウンロードし、 language=ar で Whisper を実行し、タイムスタンプとスピーカーラベルを含む転写を返します。典型的な アラビア語 コンテンツは ニュースクリップ、説教、講演、政治インタビューは アラビア語で最も一般的なワークロードです。 YouTube URLを /transcribe/youtube/に貼り付けるか、ファイルをアップロードします。 です。

Whisperは音声の1分あたり50トークンを費やします。1時間の録音は約3,000トークンです。 多くのユーザは何も使いません。30,000トークンの無料の日々のプールは短いクリップ、ボイスメモ、一度のポッドキャストをカバーします。それ以外の転写は使用分のみ支払い、トークンは$1から充電できます。

はい - セグメントレベル (10-30秒ごと) とワードレベルのタイムスタンプが使用できます。ワードレベルは VTT/SRT 字幕エクスポートのデフォルトですので、キャプションは行ごとに同期されます。API では、要求のボディに timestamps="word" を設定します。アラビア語 のトランスクリプトは、右から左へのネイティブスクリプトで返され、RTL認識ビューア(ブラウザ、Word、Google Docs)で正しくレンダリングされます。

音声 (multipart/form-data, フィールド名 "file") を /v1/transcribe/ に language=ar で POST します。または Whisper が自動検出するように言語パラメータを省略します。 JSON に転写、セグメント、タイムスタンプ、スピーカーラベルを返します。 /api/ に完全な参照と SDK スニペットがあります。

翻訳が完了したら、翻訳をクリックし、テキストを /translate/ に貼り付けます。アラビア語 は他の言語 (200 以上) とペアリングします。会議録の場合は /summarize/ に転写を送ります。ダビングの場合は /voice/tts/ に送ります。目的言語の音声を再生します。

Whisper は数十万時間の実世界のオーディオを訓練され、アラビア語 では背景ノイズや電話品質の録音に耐えます。最良の結果を得るには、クリーンなオーディオ (ヘッドセットマイク、音楽ベッドなし) を提供してください。このレベルではノイズがベースラインエラー率を複雑化します。トランスクリプトが使えなくなった場合は、ファイルとともに contact@free.ai にメールしてください。トークンを返金し、他のエンジンが音声をよりよく処理できるかを調べます。

Love Free.ai? Tell your friends!

このページを評価