Parler-TTS Large

Free.ai (self-hosted) · tts · ~500 توکنها در هر clip · 4.6 از 5 کاربران در این دسته
~500 توکنها در هر clip

. Parler-TTS Large a متن به گفتار ساخته شده توسط HuggingFace Strongest at Controllable speech ("spoken quickly with a British accent"), research.. Free.ai GPUs self-hosted — freely runs against your daily token pool (500 tokens برحسب کلیپ). انتشار تحت Apache 2.0 - استفاده تجاری اجازه داده شده در Free.ai.

پرسشهای متداول

Parler-TTS Large از طیف گسترده‌ای از زبان‌ها پشتیبانی می‌کند. فهرست دقیق به موتور بستگی دارد؛ فرم در این صفحه هر متنی را قبول می‌کند و موتور به زبان‌های پشتیبانی شده آن را نمایش می‌دهد. اگر به یک زبان خاص نیاز دارید ، برای انتخاب‌کننده چند موتور کامل ، /voice/ را ببینید.

بیشتر موتورها به صورت پیش‌فرض انگلیسی آمریکایی خنثی را نمایش می‌دهند و یک لهجه مناسب منطقه برای زبان‌های غیر انگلیسی. موتورهای Premium ممکن است انواع لهجه را نشان دهند - برای مقایسه نمونه را بچسبانید.

پشتیبانی SSML با موتور متفاوت است. برچسبهای توقف ، نظم و تأکید در بیشتر موتورهای پرمیوم و تعداد کمی از موتورهای خود میزبان رعایت می‌شوند. متن ساده همیشه کار می‌کند - هیچ علامت‌گذاری نیازی نیست.

پخش TTS در موتورهای پریمیوم از طریق /v1/tts/ API endpoint با stream=true در دسترس است. وب UI در این صفحه کلیپ کامل را پس از پایان رندرینگ باز می‌گرداند.

Parler-TTS Large روی GPUهای خودمان اجرا می‌شود. نسل اول از مجموعه روزانه رایگان شما استفاده می‌کند. وقتی خالی شد، توکن‌های پرداختی از $۵ → ۲۰۰۰۰۰ توکن شروع می‌شوند. تقریباً ~۵ توکن برای هر کاراکتر، حداقل ۱۰۰ برای هر کلیپ.

Up to 5,000 characters per request on the web UI. For longer pieces (audiobooks, full chapters), use /voice/audiobook/ which chunks and stitches automatically, or call the API in a loop.

بله - یک لیست از رشته‌ها را به /v1/tts/batch/ POST کنید، یا از رابط کاربری فضای کاری در /workspace/ استفاده کنید تا TTS را به یک خط لوله طولانی‌تر زنجیر کنید (مثلاً، ترجمه → صحبت کردن → ست کردن).

بله - متن POST به /v1/tts/ با model=" Parler-TTS Large "(یا slug در این صفحه). WAV یا MP3 را برمی‌گرداند. برای مرجع کامل + قطعه‌های SDK ، /api/ را ببینید.

این صفحه متن به گفتار است، نه شبیه‌سازی صدا - صدا پیش‌فرض موتور است. برای شبیه‌سازی صدا (بارگذاری یک صدای مرجع)، /voice/clone/ را ببینید، که نیازمند این است که شما یا مالک حقوق صدا باشید یا اجازهٔ کتبی صریح داشته باشید.

موتورهای خود میزبانی‌شده بر روی GPUهای Free.ai اجرا می‌شوند؛ هیچ‌چیز سرورهای ما را ترک نمی‌کند. موتورهای پرمیوم متن را به ارائه‌دهندگان مدل بالادستی تحت DPA ما می‌دهند. ما روی ورودی‌های شما آموزش نمی‌دهیم و داده نمی‌فروشیم.

بله - Free.ai اجازه استفاده تجاری از صدای تولید شده را می‌دهد. مجوز موتور (Apache 2.0، MIT، یا شرایط فروشنده) در بالا و در صفحه مرجع مدل نشان داده می‌شود؛ در عمل این به این معنی است که صداگذاری، تبلیغات، پادکست‌ها و برنامه‌ها همگی در محدوده قرار دارند.

بله - کارهای شکست خورده به منبع خودکار بازگردانده می‌شوند (جمع‌آوری روزانه یا نشانه‌های پرداخت شده). اگر بازگرداندن در همان روز ظاهر نشود، به contact@free.ai پیام الکترونیکی بفرستید.

دوست Free.ai رو به دوستانت بگو

رتبه این صفحه