AudioLDM 2

Free.ai (self-hosted) · music · ~5000 الرموز لكل track · 3.9 من 8 المستخدمون في هذه الفئة
~5000 الرموز لكل track

AudioLDM 2 هو a نموذج توليد الموسيقى الذي بنته Haohe Liu. أقوى في Music generation from text. استضافة ذاتية على Free.ai GPUs — يعمل مجانا ضد مجمع الرموز اليومية (5,000 tokens لكل مسار). تم إصداره تحت Apache 2.0 - الاستخدام التجاري مسموح به تحت Free.ai.

الاستخدام عن طريق رابطة البرمجيات المشتركة

API REST متوافق مع OpenAI. تولد مفتاحاً وتدعو هذا النموذج في ثوانٍ.

curl -X POST https://api.free.ai/v1/music/generate/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"audioldm2","prompt":"your prompt here"}'
وثائق API الحصول على مفتاح API

الأسئلة المتكررة

يقوم AudioLDM 2 بإنشاء موسيقى آلية أصلية (و في بعض المحركات، صوت) من نص مطلوب. وصف المزاج، النوع، الآلات، أو BPM و AudioLDM 2 يعيد مسار صوت كامل.

10 إلى 60 ثانية لكل جيل اعتمادا على المحرك. بالنسبة للقطع الأطول، تسلسل الأجيال المتعددة من خلال /music/stitch/ أو توليد في 30 ثانية الأجزاء والتلاشي المتقاطع.

بعض المحركات تقوم بتوليف الصوت من الكلمات التي تقدمها (ضع الكلمات في النموذج)؛ وبعضها الآخر يقوم بذلك فقط للأدوات. حدد النموذج على هذه الصفحة - حقل الكلمات يعني أن الصوت مدعم.

البوب، الروك، EDM، الجاز، البيئة، الكلاسيكية، لو-في، الهيب هوب الأدوات كلها تنتج بشكل معقول. أنواع المكان (غاميلان، كارناتك، الغناء الحلق) هي أضعف - وصف الأدوات صراحة لأفضل النتائج.

AudioLDM 2 يجري على وحدات المعالجة المركزية الخاصة بنا ضد مجمعك اليومي المجاني أولاً؛ $5 → 200,000 الرموز المدفوعة بعد ذلك. حوالي ~ 5,000 الرموز لكل مسار.

WAV تلقائياً (غير مفقود، جاهز لمزيد من المزج). MP3 متاح في مختبر الخرج للملفات الأصغر.

لا. AudioLDM 2 يعيد مسار مختلط. لتقسيمه إلى مسارات صوتية، تشغيل المخرج من خلال /music/stem-splitter/، الذي يستخرج الصوت، الطبول، الباص وغيرها.

نعم - /batch/ يقبل قائمة من الطلبات. كل مسارات تصل إلى /account/?tab=history مع الطلب كإسم الملف. لمزيد من التحكم، استخدم API.

نعم - POST التعليمات إلى /v1/music/generate/ مع model="AudioLDM 2". /api/ لديها المرجع الكامل بما في ذلك الكلمات، والمدة، وبارامترات الوتيرة.

AudioLDM 2 لا يستنسخ المكونات المحمية بحقوق الطبع - الخرجات هي مصنوعة حديثا. Free.ai يمنح الاستخدام التجاري؛ أنت تحتفظ بحقوق المسارات التي أنتجتها. تسمية فنان في الطلب يطلب "على غرار" - الصوت الفعلي هو الأصلي.

15 seconds to 2 minutes per track depending on duration + engine. Premium models finish faster. Use the queue button to close the tab - result lands in /account/?tab=history when done.

نعم - فشل إعادة العرض التلقائي. بالنسبة للمقطوعات التي قامت ولكن الصوت سيء، بريد إلكتروني contact@free.ai مع رابط المشاركة ونحن سنراجع حالة بحال.

أحب Free.ai؟ أخبر أصدقائك!

تقييم هذه الصفحة