Chatterbox Multilingual

Free.ai (self-hosted) · tts · ~500 توکنها در هر clip · 4.5 از 4 کاربران در این دسته
~500 توکنها در هر clip

Chatterbox Multilingual is a متن به گفتار built by Resemble AI. «بهترین فیلم‌های سال ۲۰۱۵» ‎(فارسی)‎. Free.ai GPUs self-hosted — freely runs against your daily token pool (500 tokens برحسب نوار). Released under MIT — commercial use permitted on Free.ai.

استفاده از طریق API

API REST سازگار با OpenAI. یک کلید تولید کنید و این مدل را در چند ثانیه فراخوانی کنید.

curl -X POST https://api.free.ai/v1/tts/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"chatterbox-multi","text":"hello world"}'
مستندات API دریافت کلید API

پرسشهای متداول

Chatterbox Multilingual supports a wide range of languages. The exact list depends on the engine; the form on this page accepts any text and the engine will render in its supported languages. See /voice/ for the full multi-engine picker if you need a specific language.

بیشتر موتورها به صورت پیش‌فرض انگلیسی آمریکایی خنثی را نمایش می‌دهند و لهجه‌های مناسب برای زبان‌های غیر انگلیسی. موتورهای پریمیوم ممکن است انواع لهجه‌ها را نشان دهند - یک نمونه را برای مقایسه چسباندن.

پشتیبانی SSML با موتور متفاوت است. برچسبهای توقف ، قافیه و تأکید در بیشتر موتورهای پرمیوم و در چند موتور خود میزبانی شده مورد احترام قرار می‌گیرند. متن ساده همیشه کار می‌کند — هیچ علامتگذاری نیازی نیست.

پخش TTS در موتورهای پریمیوم از طریق نقطه پایانی /v1/tts/ API با stream=true در دسترس است.

Chatterbox Multilingual روی GPUهای خودمان اجرا می‌شود. نسل اول از استخر روزانه رایگان شما استفاده می‌کند. هنگامی که خالی شد، توکن‌های پرداختی از $۵ → ۲۰۰۰۰۰ توکن شروع می‌شوند. تقریباً ~۵ توکن برای هر کاراکتر، حداقل ۱۰۰ برای هر کلیپ.

برای قطعات طولانی‌تر (کتاب‌های صوتی، فصل‌های کامل)، از /voice/audiobook/ استفاده کنید که به صورت خودکار تکه تکه می‌شود و دوخت می‌شود، یا API را در یک حلقه فراخوانی کنید.

بله — یک لیست از رشته‌ها را به /v1/tts/batch/ ارسال کنید، یا از رابط کاربری فضای کاری در /workspace/ استفاده کنید تا TTS را به یک خط لوله طولانی‌تر زنجیر کنید (مثلاً، ترجمه → صحبت کردن → ست کردن).

بله — متن POST به /v1/tts/ با model="Chatterbox Multilingual" (یا slug در این صفحه). WAV یا MP3 را برمی‌گرداند. برای مرجع کامل + قطعه‌های SDK /api/ را ببینید.

این صفحه متن به گفتار است، نه شبیه‌سازی صدا — صدا پیش‌فرض موتور است. برای شبیه‌سازی صدا (بارگذاری یک صدای مرجع)، به /voice/clone/ مراجعه کنید، که نیازمند این است که شما یا مالک حقوق صدا باشید یا اجازهٔ کتبی صریح داشته باشید.

موتورهای خود میزبانی بر روی GPUهای Free.ai اجرا می‌شوند؛ هیچ چیز سرورهای ما را ترک نمی‌کند. موتورهای Premium متن را به ارائه‌دهندگان مدل بالادستی تحت DPA ما می‌دهند. ما روی ورودی‌های شما آموزش نمی‌دهیم و داده نمی‌فروشیم.

بله - Free.ai اجازه استفاده تجاری از صدای تولید شده را می‌دهد. مجوز زیربنایی موتور (Apache 2.0، MIT، یا شرایط فروشنده) در بالا و در صفحه مرجع مدل نشان داده می‌شود؛ در عمل این به این معنی است که صداگذاری، تبلیغات، پادکست‌ها و برنامه‌ها همگی در محدوده قرار دارند.

بله — کارهای شکست خورده به صورت خودکار به منبع بازگردانده می‌شوند (گزارش روزانه یا توکن‌های پرداختی). اگر بازگرداندن در همان روز رخ ندهد، ایمیل به contact@free.ai بفرستید.

دوست Free.ai رو به دوستانت بگو

رتبه بندی این صفحه