ElevenLabs STT

Free.ai · stt · ~500 För varje minute

Släpp en ljud- eller videofil, eller klistra in en webbadress nedan

~500 För varje minute
Springer fritt på våra GPU:er. Uppgradera för ElevenLabs STT →

ElevenLabs STT är a Modell för tal-till-text. Routed genom externa modeller - ~500 tokens per minut (50 % uppräkning över uppströms kostnad).

Använd via API

OpenAI-kompatibelt REST API. Skapa en nyckel och ring denna modell på några sekunder.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"premium/elevenlabs/speech-to-text","audio_url":"https://..."}'
API-dokumentation Hämta API- nyckel

Vanliga frågor

ElevenLabs STT transkriberar talat ljud till text. Ladda upp en MP3, WAV, M4A, eller videofil och ElevenLabs STT returnerar hela utskriften plus valfria SRT/VTT textning med tidsstämpel.

ElevenLabs STT handles dozens of languages - Whisper-family models cover 90+, others vary. Pick "auto-detect" or specify the language for highest accuracy.

Ord-terror är 5-10% på ren engelsk ljud, 10-20% på bullriga eller accented ljud. Stora varianter av samma arkitektur gör meningsfullt bättre på hårda fall - plocka större när ljudet är grov.

Ja - varje segment inkluderar start/slut tidsstämpel. Exportera som SRT eller VTT och tidskartan direkt till din video.

ElevenLabs STT är en premium transkription motor. Om ~500-1,500 tokens per minut av ljud, visas live innan du genererar. Självvärdig transkription körs gratis på din 30 000-boken dagliga pool; premium modeller är pay-as-you-go, med toppar från $ 1.

MP3, WAV, M4A, FLAC, OGG, plus video (MP4, MOV, WebM) - vi extraherar ljudet. Max 500 MB per uppladdning. Längre filer? Dela med /audio/cut/ eller använd /v1/st/batch/.

Högtalardiarization är ett separat pass - växla "diarize" på /transcribe /. ElevenLabs STT hanterar transkription; diarization etiketter varje segment med högtalare 1 / högtalare 2 / etc.

Ja - / batch / accepterar en katalog med ljudfiler. Varje utskrift landar i / account/?tab= historia med det ursprungliga filnamnet. För mappträdsbevarande använd API:et.

Ja - Skicka ditt ljud till /v1/st/transcribe/ med modell="ElevenLabs STT". Returnerar JSON med text + segment + ordnivå tidsstämpel. /api/ har den fullständiga referensen.

Självvärdiga modeller håller ljud på våra GPU:er; premium passera genom med en DPA. Ljud raderas efter share-window (24h anon, 7d inloggade). Vi tränar inte på dina ingångar.

Ja - Free.ai beviljar kommersiell användning av utskrifter. Du behöver rättigheter till det ljud du laddat upp (din egen inspelning, licensierat material eller innehåll med samtycke).

Realtidsfaktorn är ungefär 0,05-0,2× - en 60-minuters podcast transkriberar i 3-12 minuter. Premium modeller ofta slutar snabbare. Använd köknappen för att stänga fliken.

Love Free.ai? Tell your friends!

Betygsätt denna sida