Sesame CSM-1B

Free.ai (self-hosted) · tts · ~500 znaki na clip · 4.3 od 3 Użytkownicy tej kategorii
~500 znaki na clip

__FREEAI_PH_Lead{article____freeai_ph_kategoria} zbudowana przez {prowider}. Najsilniejszy w Real-time voice agents, conversational AI, streaming TTS where time-to-first-audio matters more than studio-perfect reads.. Samodzielnie umieszczony na Free.ai GPU – biegnie wolny od codziennego zbiornika żetonów (500 žetonów na klip). Uwolnione pod {licence} — użytkowanie handlowe dozwolone na Free.ai.

Użyj przez API
curl -X POST https://api.free.ai/v1/tts/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"csm-1b","text":"hello world"}'
Dokumentacja API Pobierz klucz API

Często zadawane pytania

Sesame CSM-1B obsługuje szeroki zakres języków. Dokładna lista zależy od silnika; formularz na tej stronie akceptuje dowolny tekst i silnik będzie wyświetlany w obsługiwanych językach. Zobacz /voice/ dla pełnego wybieracza wielosilnika, jeśli potrzebujesz określonego języka.

Większość silników czyni neutralny amerykański angielski domyślnie i odpowiedni akcent regionowy dla języków nieangielskich. Motory premium mogą wystawić warianty akcentu — wklej próbkę do porównania.

Wsparcie SSML różni się w zależności od silnika. Pauza, prozodia i znaczniki akcentu są respektowane na większości silników premium i na kilku samorządzonych. Prosty tekst zawsze działa – nie wymaga się znaczenia.

Streaming TTS jest dostępny na silnikach premium za pomocą punktu końcowego /v1/tts/ API z stream=true. Web interfejs na tej stronie zwraca pełny klip po wykończeniu.

Sesame CSM-1B działa w naszych własnych GPU. Pokolenie czerpa najpierw z codziennego bezpłatnego basenu. Po wyczerpaniu, zapłacone żetony zaczynają się od $5 → 200 000 żetonów. Zgrubnie ~5 żetonów na znak, minimum 100 na klip.

Do 5000 znaków na żądanie w interfejsie internetowym. Dla dłuższych kawałków (Audiobooks, pełne rozdziały), użyj /voice/audiobook / które kawałki i szwy automatycznie, lub wywołaj API w pętli.

Tak — POST lista strun do /v1/tts/batch /, lub użyć interfejsu roboczego w /pracownik / do łańcucha TTS do dłuższego rurociągu (np. przetłumaczenie → mów → szw).

Tak – tekst POST do /v1/tts/ z modelem="Sesame CSM-1B" (lub łużka na tej stronie). Zwraca WAV lub MP3. Patrz /api/ dla pełnego odniesienia + SDK fragmenty.

Ta strona jest tekst-to-speech, a nie klonowanie głosu – głos jest domyślnym silnikiem. Dla klonowania głosu (rozładowywania dźwięku referencyjnego), patrz /voice/clone /, który wymaga od Ciebie albo posiada prawa głosowe lub posiada wyraźną pisemną zgodę.

Samodzielne silniki działają na Free.ai własnych GPU; nic nie opuszcza naszych serwerów. Silniki Premium przekazują tekst dostawcom modeli górnego stream w ramach naszego DPA. Nie trenujemy na wejściach i nie sprzedajemy danych.

Tak — Free.ai przyznaje komercyjne wykorzystanie generowanego dźwięku. Licencja fundamentalna silnika (Apache 2.0, MIT lub warunki dostawcy) jest wyświetlana powyżej i na stronie referencyjnej modelu; w praktyce oznacza to głosowe, reklamy, podcasty i aplikacje są wszystkie w skali.

Tak – niepowodzenie automatycznego zwrotu kosztów pracy do źródła (dawny basen lub zapłacone żetony). Jeżeli refundacja nie pojawia się w tym samym dniu, email contact@free.ai.

Love this tool? Share it!

Oszacuj tę stronę