自由な転写 チベット語
人工知能で チベット語 のオーディオとビデオをテキストに変換します。高速で正確で無料です。
どうやって働くのか
- 次へ Free.ai Transcriber
- 音声またはビデオファイル チベット語 をアップロード
- 私たちのAIは自動的に チベット語を検出し、それを転写します
- テキストまたは SRT 字幕として転写をダウンロードします
チベット語 転写機能
- ✓faster-whisper によって提供 (MIT ライセンス)
- ✓自動的に チベット語 言語を検出
- ✓MP3、WAV、MP4、M4A、FLACなどをサポート
- ✓タイムスタンプと字幕エクスポート (SRT)
- ✓有料プランではファイルサイズ制限なし
- ✓プライベートでセキュリティの高い -- ファイルは処理後に削除されます
言語の詳細
| 言語 | チベット語 |
| ISOコード | bo |
| AIモデル | faster-whisper |
| プライス | フリー |
その他の言語
すべての言語を表示よくある質問
チベット語は Whisper のためのリソースの少ない言語で、大型 v3 ターボは 25% の単語誤り率以上、時にはそれ以上になります。 転写は検索とgistに有用ですが、公開準備済みとは扱わないでください。 チベット語のためのより高精度なエンジンが利用可能になれば、自動的にそれをワイヤーインします。(ベンチマークセットにおける階層D,over 25% word error rate-マーケティングクレームではなく,正直なWER階層を公開する。
はい - チベット語 転写はまず毎日のフリートークンプールから引く。オーディオは分当たり約 50 トークンかかります。匿名の毎日プールは毎日数時間のオーディオをカバーします。ログインしたアカウントはより大きな 30,000 トークン毎日プールを得ます。それ以外の転写は使用分ごとに支払い、トークン充填は $1 からです。
チベット語 の転写は、言語の正規綴りの標準UTF-8で返されます。
音声ファイルは、MP3、WAV、M4A、FLAC、OGG、OPUS、WEBM が直接受け入れられます。ビデオ (MP4、MOV、MKV) の場合、サーバ側で音声トラックを抽出し、それを Whisper に送信します。自分で何も変換する必要はありません。チベット語 を含むソース言語に関係なく同じパイプラインを使用します。
匿名アップロードの上限はファイルごとに約 500 MB です。ログインしたアカウントは最大 2 GB までです。長さは制限されません。長いファイルは自動的にチャンクされます(30 秒のウィンドウが重なり合い、連続したタイムスタンプを持つ単一の記録に再編集されます)。数時間の チベット語 録音(ポッドキャスト、講義全体、会議)は大丈夫です。
はい - すべての チベット語 の転写に対して、デフォルトでスピーカーの日付記録が有効になります。出力は、タイムスタンプを付けて、スピーカー 1 / スピーカー 2 / スピーカー 3 に分割されます。インタビュー、パネル討論、多人数の会議はラベル付きで返されます。日付記録は別のモデルで実行され、我々がサポートするすべての言語で同じように動作します。
はい - URL を YouTube の場合は /transcribe/youtube/ に、ポッドキャストの場合は /transcribe/podcast/ に貼り付けます。オーディオをダウンロードし、 Whisper で language=bo で実行し、タイムスタンプとスピーカーラベルを含む転写を返します。典型的な チベット語 のコンテンツは、 講義、インタビュー、ボイスメモ、YouTubeのコンテンツは チベット語 で全て動作します。URLを /transcribe/youtube/ に貼り付けるか、直接ファイルをアップロードしてください。 です。
Whisperは音声の1分あたり50トークンを費やします。1時間の録音は約3,000トークンです。 多くのユーザは何も使いません。30,000トークンの無料の日々のプールは短いクリップ、ボイスメモ、一度のポッドキャストをカバーします。それ以外の転写は使用分のみ支払い、トークンは$1から充電できます。
はい - セグメントレベル (10-30秒ごと) とワードレベルのタイムスタンプが使用できます。ワードレベルは VTT/SRT 字幕エクスポートのデフォルトですので、キャプションは行ごとに同期されます。API では、要求のボディに timestamps="word" を設定します。チベット語 の転写は、言語の正規綴りの標準UTF-8で返されます。
はい。 /v1/transcribe/ に音声 (multipart/form-data, フィールド名 "file") を language=bo で POST します。または、 Whisper が自動検出するように言語パラメータを省略してください。 転写、セグメント、タイムスタンプ、スピーカーラベルを含む JSON を返します。 /api/ に完全な参照と SDK スニペットがあります。
はい - 転写が終わったら、 翻訳をクリックし、またはテキストを /translate/ に貼り付けます。チベット語 は、我々がサポートするすべての言語 (200+) とペアリングします。会議の記録の場合は、転写を /summarize/ に送ります。ダビングの場合は、目的言語のオーディオをレンダリングするために /voice/tts/ に送ります。
Whisper のノイズ訓練はこのレベルでは役に立ちません。ボトルネックは訓練中に チベット語 のオーディオ Whisper が見た量であり、ノイズではありません。クリーンなスタジオオーディオはノイズオーディオを打ち負かすことはできますが、どちらも高リソース言語で得られる精度には達しません。もし、転写が使用できない場合は、ファイルとともに contact@free.ai にメールしてください。トークンを返金し、他のエンジンがよりよくオーディオを扱うかどうかを見てみます。