Stem Separator (Mel-Band RoFormer + SCNet)
Free.ai (self-hosted)
·
audio_separate
·
~1000 1個あたりのトークン数 track
Stem Separator (Mel-Band RoFormer + SCNet)はa,ステム分離モデルである。 Strongest at Vocal/stem separation. Free.ai GPU でセルフホストされ、毎日のトークンプール(1,000トークン、1曲あたり)に対してフリーで動作します。 ライセンスはMIT + Apache-2.0でリリースされ、商用利用はFree.aiで許可されている。
API を使う
OpenAI 互換の REST API。鍵を生成し、数秒でモデルを呼び出す。
curl -X POST https://api.free.ai/v1/music/separate/ \
-H "Authorization: Bearer sk-free-..." \
-H "Content-Type: application/json" \
-d '{"model":"demucs","prompt":"your prompt here"}'
API ドキュメント
API キーを取得
よくある質問
Stem Separator (Mel-Band RoFormer + SCNet) はミックスされたオーディオトラックをステムに分割します。ステムはボーカル、ドラム、ベース、その他の楽器で、それぞれ独自のオーディオファイルとして作成されます。MP3 または WAV をアップロードすると、Stem Separator (Mel-Band RoFormer + SCNet) はリミックスまたはミュートできる 4 つのステムファイルを返します。
よくミックスされたスタジオトラックでは非常にクリーンです: ボーカルとインストゥルメンタルはほとんどブリーディングなく分離され、ドラムとベースはクリーンに出力されます。古いライブ録音や圧縮された録音はステム間のクロストークが多く分離されます。
4 つのステム: ボーカル、ドラム、ベース、その他。インストゥルメンタルトラック (ボーカル以外の全て) もワンクリック出力として利用できます。
MP3, WAV, FLAC, M4A, OGG 50MBまで。ステレオ入力は最もクリーンな結果を与えます。モノは処理前にステレオにアップスケールされます。
Stem Separator (Mel-Band RoFormer + SCNet)は、GPU上で、 まず、 あなたの日々のフリープールに対して実行されます。$5 → 200,000 有料トークン。 音声の1分あたり約1,000トークン。
はい - ステンマを抽出し、インストゥルメンタルの場合は「ドラム + ベース + 他」を一緒にダウンロードします。アカペラの場合は「ボーカル」のみをダウンロードします。上のフォームはワンクリックで「インストゥルメンタル」の出力を提供します。
はい - 分離はタイミングやピッチを変更しません。ステムはフレームごとにソースに合わせて整列し、きれいにリミックスされます。
はい - /batch/ はオーディオファイルのフォルダを受け入れます。各出力 (ソースごとに 4 個のステム) は /account/?tab=history に移動します。フォルダのツリーを保存するには API を使用してください。
音声を /v1/music/separate/ に POST すると、ステムごとにダウンロード URL を返します。 /api/ には、送るモデル id を含む完全なリファレンスがあります。
ソース音声の権利が必要です。Free.ai は、自分が所有していない音声の権利を与えることはできません。チャートポップ曲を分離することは、そのステムを公開することを合法化しません。
標準は WAV (無損失、リミックス可能)。 MP3 はフォーマット選択画面で小さなダウンロードに使用できます。
リアルタイムの要素は約 0.1-0.3× で、4 分の曲は 30-80 秒で分離します。キューボタンを使ってタブを閉じます。