StyleTTS 2

Free.ai (self-hosted) · tts · ~500 প্রতি clip · 4.6 থেকে 5 এই শ্রেণীর ব্যবহারকারী
~500 প্রতি clip

StyleTTS 2 হল a টেক্সট-টু-স্পিকিং শব্দ Yinghao Aaron Li দ্বারা নির্মিত। সবচেয়ে শক্তিশালী Voice cloning without training data; expressive multilingual speech.. Free.ai GPUs-এ স্ব-হোস্ট করা - আপনার দৈনিক টোকেন পুলের বিরুদ্ধে বিনামূল্যে চলছে (500 টোকেন প্রতি ক্লিপ)। MIT লাইসেন্সের অধীনে প্রকাশিত - বাণিজ্যিক ব্যবহারের অনুমতি Free.ai লাইসেন্সের অধীনে।

প্রায়শ জিজ্ঞাসিত প্রশ্ন

StyleTTS 2 একটি বিস্তৃত ভাষা সমর্থন করে। সঠিক তালিকা ইঞ্জিনের উপর নির্ভর করে; এই পৃষ্ঠায় ফর্ম যেকোন টেক্সট গ্রহণ করে এবং ইঞ্জিন তার সমর্থিত ভাষায় রেন্ডার করবে। একটি নির্দিষ্ট ভাষার প্রয়োজন হলে পূর্ণ মাল্টি-ইঞ্জিন নির্বাচনকারীর জন্য /voice/ দেখুন।

বেশিরভাগ ইঞ্জিন ডিফল্টভাবে নিরপেক্ষ- আমেরিকান ইংরেজি এবং অ- ইংরেজি ভাষার জন্য অঞ্চল- অনুযায়ী উচ্চারণ প্রদর্শন করে । প্রিমিয়াম ইঞ্জিন উচ্চারণ বৈচিত্র্য প্রকাশ করতে পারে - তুলনা করার জন্য নমুনাটি আঠালো করুন ।

এস- এস- এম- এল সমর্থন ইঞ্জিন দ্বারা ভিন্ন হয় । বিরতি, প্রসোডি, এবং emphasis ট্যাগ বেশিরভাগ প্রাইম ইঞ্জিন এবং কিছু স্ব- হোস্ট করা একটি সম্মানিত । প্লেইন টেক্সট সবসময় কাজ করে - কোন মারকিং প্রয়োজন হয় না ।

স্ট্রিমিং TTS প্রাইম ইঞ্জিন /v1/tts/ API endpoint এর মাধ্যমে stream=true এর সাথে উপলব্ধ। এই পৃষ্ঠার ওয়েব UI পূর্ণ ক্লিপ ফিরিয়ে দেয় রেন্ডারিং শেষ হওয়ার পর।

StyleTTS 2 আমাদের নিজস্ব GPU-তে চলছে। প্রথমে আপনার দৈনিক ফ্রি পুল থেকে প্রজন্ম আঁকুন। একবার ব্যবহৃত হলে, পে-টোকেন শুরু হবে $৫ → ২০০,০০০ টোকেন। প্রতিটি অক্ষরের জন্য প্রায় ~৫ টোকেন, প্রতিটি ক্লিপের জন্য সর্বনিম্ন ১০০।

ওয়েব ইউআই-এর প্রতি অনুরোধের জন্য সর্বোচ্চ ৫,০০০ অক্ষর। দীর্ঘ অংশের জন্য (অডিওবই, পূর্ণ অধ্যায়), /voice/audiobook/ ব্যবহার করুন যা স্বয়ংক্রিয়ভাবে চূর্ণ এবং স্টাইল করে, অথবা API-কে একটি লুপ-এ ডাকুন।

হ্যাঁ - /v1/tts/batch/-এ স্ট্রিং-এর একটি তালিকা পোস্ট করুন, অথবা /workspace/-এ workspace UI ব্যবহার করে TTS-কে একটি দীর্ঘ পাইপলাইনে সংযুক্ত করুন (যেমন, translate → speak → stitch)।

হ্যাঁ - /v1/tts/-এ model="StyleTTS 2" (অথবা এই পৃষ্ঠার slug) সহযোগে লেখা POST করুন। WAV অথবা MP3 ফিরিয়ে দেয়। সম্পূর্ণ রেফারেন্স + SDK স্নিপেট দেখুন /api/।

এই পাতাটি টেক্সট-টু-স্পিকিং, শব্দ ক্লোনিং নয় - শব্দ ইঞ্জিনের ডিফল্ট। শব্দ ক্লোনিং (অডিও রেফারেন্স আপলোড করা) জন্য, /voice/clone/ দেখুন, যা আপনার শব্দের অধিকার অথবা স্পষ্ট লিখিত অনুমতি প্রয়োজন।

Free.ai-এর মালিকানাধীন GPU-তে স্ব-হোস্ট ইঞ্জিন চালানো হয়; আমাদের সার্ভার থেকে কিছুই বের হয় না। প্রিমিয়াম ইঞ্জিন টেক্সট আমাদের DPA-র অধীনে আপস্ট্রিম মডেল প্রদানকারীদের কাছে পাঠায়। আমরা আপনার ইনপুটগুলিতে প্রশিক্ষণ দিই না এবং তথ্য বিক্রি করি না।

হ্যাঁ - Free.ai বাণিজ্যিকভাবে অডিও তৈরির অনুমতি প্রদান করে। ইঞ্জিনের নিম্নলিখিত লাইসেন্স (Apache 2.0, MIT, বা বিক্রেতার শর্ত) উপরে এবং মডেল রেফারেন্স পাতায় দেখানো হয়েছে; প্রয়োগিকভাবে এর অর্থ হচ্ছে, শব্দ, বিজ্ঞাপন, পডকাস্ট এবং অ্যাপলিকেশন সবই এর মধ্যে রয়েছে।

হ্যাঁ - ব্যর্থ কাজ স্বয়ংক্রিয়ভাবে উৎস (দৈনিক পুল অথবা পরিশোধিত টোকেন)-এ ফেরত পাঠানো হবে। যদি একই দিনে ফেরত পাঠানো না হয়, contact@free.ai-এ ই-মেইল করুন।

Free.ai ভালোবাসো?

এই পাতাটি রেটিং দিন