Parler-TTS Large

Free.ai (self-hosted) · tts · ~500 ชิ้น clip · 4.6 จาก 5 ผู้ใช้ในหมวดหมู่นี้
~500 ชิ้น clip

Parler-TTS Large เป็น a เสียงคำพูดComment สร้างโดย HuggingFace แข็งแกร่งที่สุดที่ Controllable speech ("spoken quickly with a British accent"), research. จัดเก็บข้อมูลด้วยตนเองบน Free.ai GPUs — ทำงานฟรีกับสระของโต๊ะประจำวันของคุณ (500 โต๊ะ ต่อคลิป) ปล่อยออกมาภายใต้ Apache 2.0 - การใช้งานในเชิงพาณิชย์อนุญาตบน Free.ai

คำถามที่ถามบ่อย

Parler-TTS Large รองรับภาษามากมาย รายการที่ถูกต้องขึ้นอยู่กับกลไกการทำงานของเครื่อง; แบบฟอร์มบนหน้านี้ สามารถรับข้อความได้ทุกภาษา และกลไกจะแสดงผลในภาษาที่รองรับ หากต้องการเลือกภาษาที่เฉพาะเจาะจง โปรดดูที่ / voice / เพื่อเลือกกลไกการทำงานหลายภาษา

กลไกส่วนใหญ่จะแสดงภาษาอังกฤษอเมริกันโดยปริยาย และใช้สำเนียงที่เหมาะสมกับภูมิภาคสำหรับภาษาที่ไม่ใช่ภาษาอังกฤษ กลไก Premium อาจจะแสดงสำเนียงที่แตกต่างกันได้ - ปักหมุดตัวอย่างเพื่อเปรียบเทียบ

การรองรับ SSML นั้นแตกต่างกันไปตามกลไกต่าง ๆ แท็กการหยุดชะงัก, คำอธิบายและการเน้น จะถูกใช้บนกลไกพิเศษส่วนใหญ่ และบนกลไกที่ใช้เองบางตัว ข้อความธรรมดาจะทำงานได้เสมอ - ไม่จำเป็นต้องมีมาก้า

การสตรีม TTS สามารถใช้ได้บนเครื่องมือระดับพรีเมี่ยมผ่านทาง / v1/ tts/ API endpoint ด้วย stream=true ส่วนติดต่อผู้ใช้เว็บบนหน้านี้จะส่งคลิปเต็มเมื่อการแสดงผลเสร็จสมบูรณ์

Parler-TTS Large ทำงานบน GPU ของพวกเราเอง สร้างจากสระที่คุณมีฟรีทุกวันก่อน เมื่อหมดแล้ว ค่าใช้จ่ายเริ่มต้นที่ $5 → 200,000 โต๊ะ ประมาณ ~5โต๊ะต่อตัวอักษร อย่างน้อย 100 ต่อคลิป

สูงสุด 5,000 อักขระต่อคำร้องขอบนเว็บ UI สำหรับส่วนที่ยาวกว่า (หนังสือเสียง, บทเต็ม) ใช้ /voice/audiobook/ ซึ่งจะแยกและต่อกันโดยอัตโนมัติ หรือเรียก API ในลูป

ใช่ - POST รายการข้อความไปยัง / v1/ tts/ batch / หรือใช้ UI ของพื้นที่ทำงานที่ / workspace / เพื่อเชื่อมต่อ TTS เข้ากับท่อที่ยาวกว่า (เช่น Translate → Speak → Stitch)

ใช่ - POST ข้อความไปยัง / v1/ tts / ด้วย model=" Parler-TTS Large "(หรือ slug ที่หน้านี้) คืนค่าเป็น WAV หรือ MP3 ดูที่ / api / สำหรับอ้างอิงที่ครบถ้วน + สแปม SDK

หน้านี้เป็นส่วนของการแปลงข้อความเป็นเสียง ไม่ใช่การโคลนเสียง - เสียงเป็นตัวกำหนดค่าของกลไก สำหรับโคลนเสียง (อัปโหลดเสียงที่อ้างอิง) โปรดดูที่ /voice/clone/ ซึ่งคุณต้องเป็นเจ้าของสิทธิ์เสียงหรือมีใบรับรองโดยอ้างอิง

กลไกที่ใช้เองทำงานบน GPU ที่ Free.ai ถือครอง ไม่มีอะไรออกจากเซิร์ฟเวอร์ของเรา กลไกพิเศษส่งข้อความไปยังผู้ให้บริการแบบจำลองด้านบนภายใต้ DPA ของเรา เราไม่ฝึกการเข้าถึงของคุณและไม่ขายข้อมูล

ใช่ - Free.ai อนุญาตให้ใช้เสียงที่สร้างขึ้นเพื่อการค้า ลิขสิทธิ์ของเครื่องจักร (Apache 2.0, MIT, หรือเงื่อนไขของผู้ผลิต) แสดงไว้ด้านบนและบนหน้าอ้างอิงแบบอย่าง ในทางปฏิบัติ หมายถึงเสียง, โฆษณา, พ็อดแคสต์ และแอพพลิเคชันทั้งหมดอยู่ในขอบเขต

ใช่ — งานที่ล้มเหลวจะถูกคืนเงินอัตโนมัติไปยังแหล่งที่มา (กองประจำวัน หรือ โต๊ะที่จ่ายค่าบริการ) หากการคืนเงินไม่ปรากฏในวันเดียวกัน โปรดส่งอีเมลไปที่ contact@free.ai

รัก Free.ai บอกเพื่อนของคุณ

จัดอันดับหน้านี้