Parler-TTS Large
Free.ai (self-hosted)
·
tts
·
~500 1個あたりのトークン数 clip
·
4.6
ここから 5 このカテゴリーのユーザーは
Parler-TTS Largeはa テキストから音声に変換するはHuggingFaceが作ったものだ Strongest at Controllable speech ("spoken quickly with a British accent"), research.. Free.ai GPU でセルフホストされ、毎日のトークンプール(500トークン、クリップごとに)に対してフリーで動作します。 ライセンスはApache 2.0でリリースされ、商用利用はFree.aiで許可されている。
類似モデル
よくある質問
Parler-TTS Large は多くの言語をサポートします。正確なリストはエンジンに依存します。このページのフォームはどんなテキストでも受け入れ、エンジンはサポートされている言語でレンダリングします。特定の言語が必要な場合は、 /voice/ を参照して完全なマルチエンジン選択器を見てください。
ほとんどのエンジンは標準で中立的なアメリカ英語を表示し、英語以外の言語は地域に合ったアクセントを表示します。プレミアムエンジンはアクセントの変種を表示します。比較のためにサンプルを貼り付けてください。
SSML サポートはエンジンによって異なります。休止、韻律、強調タグはほとんどのプレミアムエンジンと少数のセルフホストエンジンで尊重されます。プレーンテキストはいつでも機能します。マークアップは必要ありません。
ストリーミング TTS は、stream=true の /v1/tts/ API エンドポイントを通してプレミアムエンジンで利用できます。このページの Web UI は、レンダリングが終了したら、フルクリップを返します。
Parler-TTS Large は私たちのGPUで動作します。 生成は、 まず、 あなたの日々のフリープールから引く。 枯渇したら、 有料トークンは $5 → 200,000 トークンから始まります。 約 ~5 トークン 1 文字、 クリップあたり最低 100。
ウェブ UI での要求ごとに最大 5,000 文字まで。長い部分 (オーディオブック、全章) の場合は、自動的にチャンクとステッチを行う /voice/audiobook/ を使用するか、ループで API を呼び出す。
文字列のリストを /v1/tts/batch/ に POST するか、 /workspace/ のワークスペース UI を使って TTS を長いパイプラインに連結します。
はい - /v1/tts/ に model="Parler-TTS Large" を POST します。WAV または MP3 を返します。詳細は /api/ を参照してください。
このページはテキストから音声へのクローンではなく、音声クローンです。音声はエンジンのデフォルトです。音声クローン (参照音声をアップロード) については、 /voice/clone/ を参照してください。音声権利を持つか、明示的な書面の同意を得る必要があります。
自己ホストエンジンは Free.ai が所有する GPU 上で動作し、サーバからは何も出てこない。プレミアムエンジンは、DPA の下でテキストをアップストリームモデルプロバイダに渡します。私たちは、あなたの入力を訓練しませんし、データを売却しません。
はい - Free.ai は生成されたオーディオの商用利用を許可します。エンジンのライセンス (Apache 2.0, MIT, またはベンダーの条件) は上部とモデル参照ページに表示されます。実際には、ボイスオーバー、広告、ポッドキャスト、アプリケーションがすべて範囲内に含まれます。
はい - 失敗したジョブは自動的にソース (日々のプールまたは支払いトークン) に返金されます。返金が同日に現れない場合は、 contact@free.ai にメールしてください。