Piper

Free.ai (self-hosted) · tts · ~500 Anzahl der Token je clip · 4.6 von 5 Benutzer dieser Kategorie
~500 Anzahl der Token je clip

Piper ist a Text-zu-Sprach-Stimme, gebaut von Rhasspy. Am stärksten bei Lightweight TTS, many voices. Selbstgehostet auf Free.ai GPUs — läuft kostenlos gegen Ihren täglichen Tokenpool ({tpm__tokens} pro Clip). Veröffentlicht unter MIT - kommerzielle Nutzung auf Free.ai erlaubt.

Verwendung über API

OpenAI-kompatible REST API. Generieren Sie einen Schlüssel und rufen Sie dieses Modell in Sekundenschnelle auf.

curl -X POST https://api.free.ai/v1/tts/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"piper","text":"hello world"}'
API-Dokumentation API-Schlüssel abrufen

Häufig gestellte Fragen

Piper unterstützt eine Vielzahl von Sprachen. Die genaue Liste hängt von der Engine ab; das Formular auf dieser Seite akzeptiert jeden Text und die Engine wird in den unterstützten Sprachen rendern. Siehe /voice/ für den vollständigen Mehr-Engine-Picker, wenn Sie eine bestimmte Sprache benötigen.

Die meisten Motoren machen standardmäßig neutral-amerikanisches Englisch und einen regionsgerechten Akzent für nicht-englische Sprachen. Premium-Motoren können Akzentvarianten aussetzen - fügen Sie ein Beispiel zum Vergleich ein.

Die SSML-Unterstützung variiert je nach Motor. Pause, Prosody und Betonung Tags werden auf den meisten Premium-Motoren und auf einigen selbstgehosteten geehrt. Klarer Text funktioniert immer - kein Markup erforderlich.

Streaming TTS ist auf Premium-Engines über den /v1/tts/ API-Endpunkt mit stream=true verfügbar. Die Web-UI auf dieser Seite gibt den kompletten Clip zurück, sobald die Rendering-Endung abgeschlossen ist.

Piper läuft auf unseren eigenen GPUs. Generation zieht sich zuerst aus Ihrem täglichen freien Pool. Einmal erschöpft, beginnen bezahlte Tokens bei $5 → 200.000 Tokens. Ungefähr ~5 Tokens pro Charakter, mindestens 100 pro Clip.

Bis zu 5.000 Zeichen pro Anfrage auf der Web-UI. Für längere Stücke (Audiobücher, ganze Kapitel), verwenden /voice/audiobook/ die klunks und stichs automatisch, oder rufen Sie die API in einer Schleife.

Ja - POST eine Liste von Strings in /v1/tts/batch/, oder verwenden Sie die Workspace UI in /workspace/, um TTS in eine längere Pipeline zu ketten (z.B. übersetzen → sprechen → Stich).

Ja - POST-Text in /v1/tts/ mit model="Piper" (oder der Schnecke auf dieser Seite). Gibt WAV oder MP3 zurück. Siehe /api/ für vollständige Referenz + SDK-Schnipsel.

Diese Seite ist Text-zu-Speech, nicht Sprachklonen - die Stimme ist die Standardeinstellung des Motors. Zum Stimmenklonen (Upload eines Referenz-Audios) siehe /voice/clone/, was erfordert, dass Sie entweder die Sprachrechte besitzen oder eine ausdrückliche schriftliche Zustimmung haben.

Selbstgehostete Motoren laufen auf Free.ai-eigenen GPUs; nichts verlässt unsere Server. Premium-Engines übergeben Text an vorgelagerte Modellanbieter unter unserem DPA. Wir trainieren nicht auf Ihre Eingänge und verkaufen keine Daten.

Ja - Free.ai gewährt kommerzielle Nutzung von generiertem Audio. Die zugrunde liegende Lizenz der Engine (Apache 2.0, MIT, oder Verkäuferbegriffe) wird oben und auf der Modellreferenzseite angezeigt; in der Praxis bedeutet dies, dass Voiceovers, Anzeigen, Podcasts und Apps alle in-scope sind.

Ja - fehlgeschlagene Jobs automatisch-zurückerstatten an die Quelle (täglich Pool oder bezahlt Tokens). Wenn eine Rückerstattung nicht am selben Tag angezeigt wird, email contact@free.ai.

Liebe Free.ai? Erzählen Sie Ihren Freunden!

Bewerten Sie diese Seite