Fal Speech-to-Text

Free.ai · stt · ~500 mabao kwa kila mmoja minute

Angusha kaseti au faili ya video, au funika URUL chini

~500 mabao kwa kila mmoja minute
Wakimbiaji wakiwa huru kwa GPUs. Kurekebishwa kwa Fal Speech-to-Text →

Fal Speech-to-Text nia Picha ya mfano inayotokana na maneno na habari. Alipita sanamu za nje - BAR500 astlets kwa dakika moja (asilimia 50 ya alama juu ya gharama ya mto).

Tumia kupitia API

MFUMO wa chembe za urithi wenye uwezo sawa API. Generate ni ufunguo na kwa sekunde chache unaita kiolezo hiki.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"premium/speech-to-text","audio_url":"https://..."}'
Documenti Tafuta Faida

Maswali Ambayo Watu Huuliza Mara Nyingi

Fal Speech-to-Text transcribes spoken audio into text. Upload an MP3, WAV, M4A, or video file and Fal Speech-to-Text returns the full transcript plus optional SRT/VTT subtitles with timestamps.

Fal Speech-to-Text handles dozens of languages - Whisper-family models cover 90+, others vary. Pick "auto-detect" or specify the language for highest accuracy.

Kiwango cha maneno ni 5-10% kwenye sauti safi ya Kiingereza, asilimia 10-20 kwenye sauti ya sauti ya kelele au ya matamshi.

Ndiyo - kila sehemu inajumuisha kuanza na mwisho vipindi vya kukatuka. Export kama SRT au VT na ramani mara moja kwenye video yako.

Fal Speech-to-Text is a premium transcription engine. About ~500-1,500 tokens per minute of audio, shown live before you generate. Self-hosted transcription runs free on your 30,000-token daily pool; premium models are pay-as-you-go, with top-ups from $1.

MP3, WAV, M4A, NOAC, OG, pamoja na video (MP4, MV, WebM) - tunatoa sauti. Max 500 MB kwa kila sehemu ya juu. Mafaili marefu zaidi? Mafaili hayo yanaambatana na /udio/cuti/umika/v1/julat/batch/.

Maneno ya sauti ni njia tofauti ya kupitisha "kutengeneza" kwenye ukurasa wa kwanza/. Fal Speech-to-Text inashika nakala ya nakala; majina ya udishaji hubandikwa kila sehemu kwa kigombani cha 1 / Spika 2 / n.k.

Ndiyo - /batch/lakala ya faili za sauti. Kila nakala ya nchi katika /aclaw/?tabÉethisry kwa jina la awali la faili.

Ndiyo - Tazama sauti yako kwa /v1/strans/with mrengo"Fal Speech-to-Text". Repens JSON ikiwa na maandishi + calvel vimps. /api/ ina marejezo kamili.

Waigaji wenye ubinafsi huweka sauti kwenye mtandao wetu wa GPUs; huduma za afya hupita kwa kutumia mashine ya DPA.udio hufutwa baada ya jopo la pamoja (24h aon, 7d-in).

Ndiyo - Free.ai hutoa nakala za kibiashara ambazo unahitaji haki za kusikiliza kaseti ulizoweka (rekodi yako mwenyewe, vifaa vilivyoidhinishwa, au kuridhika na idhini).

Real-time factor is roughly 0.05-0.2× - a 60-minute podcast transcribes in 3-12 minutes. Premium models often finish faster. Use the queue button to close the tab.

Waeleze rafiki zako kuhusu mapenzi ya mapenzi ya Free.ai?

Pima ukurasa huu