MeloTTS

Free.ai (self-hosted) · tts · ~500 znaki na clip · 4.6 od 5 użytkowników tej kategorii
~500 znaki na clip

MeloTTS jest a głos tekst- do- słowa zbudowany przez MyShell. Najsilniejsza w Multilingual TTS. Samodzielnie umieszczony na Free.ai GPU – biegnie wolny od codziennego zbiornika tokenów (500 žetonów na klip). Wydawane pod MIT - użytkowanie handlowe dozwolone na Free.ai.

Użyj przez API

Kompatybilny z OpenAI REST API. Generuj klucz i zadzwoń po tym modelu w sekundach.

curl -X POST https://api.free.ai/v1/tts/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"melotts","text":"hello world"}'
Dokumentacja API Pobierz klucz API

Często zadawane pytania

MeloTTS obsługuje szeroki zakres języków. Dokładna lista zależy od silnika; formularz na tej stronie akceptuje każdy tekst i silnik wyświetli w obsługiwanych językach. Zobacz /voice / dla pełnego pikarza wielosilnika, jeśli potrzebujesz określonego języka.

Większość silników wytwarza domyślnie neutralny amerykański angielski i odpowiedni akcent regionu dla języków nieangielskich. Motory premium mogą wystawić warianty akcentu - wklej próbkę do porównania.

Wsparcie SSML różni się w zależności od silnika. Pauza, prozodia i tagi akcentowe są wyróżniane większości silników premium i kilku samo-domachestowanych. Prosty tekst zawsze działa - nie wymaga się znaczników.

Streaming TTS jest dostępny na silnikach premium za pomocą punktu końcowego /v1/tts/ API z stream=true. Web interfejs na tej stronie zwraca pełny klip po wykończeniu.

MeloTTS biegnie na własny GPU. Pokolenie czerpa z codziennego wolnego basenu. Kiedy wyczerpuje, zapłacone żetony zaczynają się od $5 → 200 000 żetonów. Zgrubnie ~5 tokena na znak, minimum 100 za klip.

Do 5000 znaków na żądanie na interfejsie internetowym. Dla dłuższych kawałków (audyo książek, pełne rozdziały), użyj /woice/audiobook / które kawałki i szwy automatycznie, lub wywołaj API w pętli.

Tak - POST lista strun do /v1/tts/batch /, lub użyj interfejsu roboczego w /pracowa przestrzeni / do łańcucha TTS do dłuższego rurociągu (np. przetłumacz → mów → szyw).

Tak - tekst POST do /v1/tts / z modelem=" MeloTTS" (lub łupka na tej stronie). Zwraca WAV lub MP3. Patrz /api / dla pełnego odniesienia + SDK fragmenty.

Ta strona jest tekstem- do-speech, a nie klonowaniem głosu - głos jest domyślnym silnika. Dla klonowania głosu (rozładowywanie dźwięku referencyjnego), patrz /voice/clone /, który wymaga od Ciebie albo posiada prawa głosowe lub posiada wyraźną pisemną zgodę.

Samodzielnie hostowane silniki działające na GPU własnych Free.ai; nic nie opuszcza naszych serwerów. Silniki Premium przekazują tekst dostawcom modeli góry w ramach naszego DPA. Nie trenujemy na wejściach i nie sprzedajemy danych.

Tak - Free.ai przyznaje komercyjne wykorzystanie generowanego audio. Licencja fundamentalna silnika (Apache 2.0, MIT lub warunki dostawcy) jest wyświetlona powyżej i na stronie referencyjnej modelu; w praktyce oznacza to głosowe, reklamy, podcasty i aplikacje są w świetle.

Tak – niepowodzenie automatycznego zwrotu kosztów pracy do źródła (dawny basen lub zapłacone tokeny). Jeżeli refundacja nie pojawia się w tym samym dniu, email contact@free.ai.

Love Free.ai? Tell your friends!

Oceń tę stronę