ElevenLabs STT

Free.ai · stt · ~500 mynter pr. minute

Slipp en lyd- eller video- fil, eller lim inn en URL nedenfor

~500 mynter pr. minute
Kjører gratis på våre GPUer. Oppgradering til ElevenLabs STT →

ElevenLabs STT er a tale-til-tekst-modell. Rutet gjennom eksterne modeller - ~500 mynter per minutt (50% oppmerking over kostnader oppstrøms).

Bruk via API

OpenAI- kompatibel REST API. Lag en nøkkel og kall denne modellen i sekunder.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"premium/elevenlabs/speech-to-text","audio_url":"https://..."}'
API- dokumentasjon Hent API- nøkkel

Ofte stilte spørsmål

ElevenLabs STT transcribes talte lyd til tekst. Last opp en MP3, WAV, M4A eller videofil og ElevenLabs STT returnerer hele utskriften pluss valgfri SRT/VTT teksting med tidsstempel.

ElevenLabs STT handles dozens of languages - Whisper-family models cover 90+, others vary. Pick "auto-detect" or specify the language for highest accuracy.

word- error rate er 5-10% på ren engelsk, 10-20% på støyende eller aksentisert lyd. Store varianter av samme arkitektur gjør meningsfylt bedre i hard- tilfeller - pick større når lyden er grov.

Ja, hvert segment inneholder start - og slutt-tidsstempel. Eksporter som SRT eller VTT og tidskart rett på videoen.

ElevenLabs STT is a premium transcription engine. About ~500-1,500 tokens per minute of audio, shown live before you generate. Self-hosted transcription runs free on your 30,000-token daily pool; premium models are pay-as-you-go, with top-ups from $1.

MP3, WAV, M4A, FLAC, OGG, pluss video (MP4, MOV, WebM) - vi trekker ut lyden. Maks 500 MB per opplasting. Lengere filer? Del med /audio/cut/ eller bruk / v1/ stt/ batch /.

Høytaler- arisering er et eget gjennomløp - slå av/ på « diarisisér » på / transcribe/. ElevenLabs STT håndterer transkriptionen. Diarisasjon merker hvert segment med høyttaler 1 / høyttaler 2 / osv.

Ja - /atch/ godtar en mappe med lydfiler. Hver utskrift lander i / account /? tab=historie med det opprinnelige filnavnet. Bruk API for mappe- tre.

Ja - SYKKKER lyden din til / v1/ st/ trancribe/ with model=" ElevenLabs STT". Returnerer JSON med tekst + segmenter + tidsstempel på ordnivå. /api/ har full referanse.

Selvværte modeller holder lyd på våre GPU- er, premium passerer gjennom med DPA. Lyden slettes etter delingsvinduet (24h anon, 7d signert). Vi trener ikke på dine inndata.

Ja - Free.ai gir kommersiell bruk av utskrifter. Du trenger rettigheter til lyden du opplastet (din egen opptak, lisensiert materiale eller innhold med samtykke).

Sanntidsfaktoren er omtrent 0.05– 0.2× – en 60- minutters podkasttranskriber på 3– 12 minutter. Premiummodeller avsluttes ofte raskere. Bruk køknappen for å lukke fanen.

Elsk Free.ai? Fortell vennene dine!

Bedøm denne siden