Podcast transkribapena

Erabilera komertziala Ados 380+ modelo Ur- markarik ez Ez da izen-ematerik behar
Modeloa:
+ GPT-5, Claude, Gemini
Igo podcast-aren atal bat eta lortu transkribapen garbia, hizlariak etiketatutakoa, isiltasun-hutsuneetatik kapitulu-markatzaileak automatikoki detektatuta. Fitxategi luzeak, 2 GB-ra arte, 99 hizkuntza, Whisper-large-v3 zehaztasuna. Esportatu SRT/VTT gisa zure bideo-podcasterako, TXT soila erakusteko oharrak, edo JSON Descript-estiloko lan-fluxuetan editatzeko.

Arrastatu eta jaregin podcastaren atal bat, edo egin klik arakatzeko

MP3, WAV, M4A, OGG, MP4 — 2 GB-ra arteko atal luzeak

- - - -
Kapitulu-markatzaileak bezeroaren aldetik segmentu-hutsuneetatik kalkulatzen dira eta transkribapenari eransten zaizkio. Itsatsi YouTube edo Spotify-ren azalpenetan dagoen bezala.
Token-estimazioa klip honentzat
-
Podcast-aren transkribapena
Autodetektatu kapituluak

Podcast-a transkribatzen...

Episodio luzeek minutu batzuk behar dituzte. Fitxa hau itxi dezakezu "postaz bidali amaitzean" aukera hautatuta badago.

Podcaster + show editoreentzat eraikia

Erakutsi oharrak itsaspen batean

Igo atal hau, deskargatu TXT. Hizlariaren etiketak lerroan, kapituluaren denbora-markak Spotify/YouTube deskribapenerako prest, blogeko artikulua 10 minututan idatzia 4 ordutan idatzi ordez.

Bideo podcastaren azpitituluak

Esportatu SRT edo WebVTT hizlari-etiketekin. Premiere, Final Cut edo DaVinci Resolve-n zuzenean jartzen ditu, edo YouTube bideoarekin batera igotzen du azpititulu garbiak lortzeko.

Testuan oinarritutako atal-edizioa

JSON esportazioak hitz bakoitza hasierako/amaierako ordu-zigiluekin ematen dizu. Descript, Reaper edo lan-fluxu pertsonalizatu batera bideratu - editatu testua nabarmenduz garbitu ordez.

Podcast-en transkribapena nola funtzionatzen duen

  1. Arrastatu zure atal bat jaregiteko eremura — MP3, WAV, M4A, MP4, 2 GB arte.
  2. Utzi ahots-etiketak eta kapitulu-markatzaileak piztuta (lehenetsiak dira). Hautatu irteera-formatua.
  3. Iraupena eta prezioa egiaztatzen ditugu tokenak gastatu aurretik. Egin klik Transkribatu botoian.
  4. Deskargatu ahoskari-etiketatutako TXT, SRT, VTT edo JSON. Kapitulu-markatzaileak alboan bidaltzen dira, itsatsita.

Free.ai podcast transkribapena vs Descript, Riverside, Otter

Egitura Free.ai Descript Riverside Otter.ai
PrezioaPay-per-use ($0.003/min)$15-30/mo$19/mo$16.99/mo
Fitxategiaren tamaina maximoa2 GB5 GBTied to record session500 MB (varies)
Ahoskariaren diarizazioa
Auto- kapitulu-markatzaileak (isilpean oinarritua)Manual-Paid tier
SRT/VTT esportazioaPaid
Hizkuntzak9922100+English-focused
API publikoa--Limited
Lehiakideen prezioek 2026an publikoki zerrendatutako maila islatzen dute. Egiaztatu hornitzaile bakoitzaren egungo planak.
Aukerak aurreratuak
Emaitza
Token gutxi. Eskuratu token gehiago
Emaitza hobeak nahi dituzu? Premium modeloak (GPT-5, Claude, Gemini) kalitate hobea ematen dute. Ikusi planoak

❤️ Free.ai maite duzu?

Izen ematea erreferentzia-esteka bat lortzeko eta 30.000 token lagun bakoitzeko irabazteko.

Gehiago nahi duzu? Izena eman doan 30K token/egun + 10K bonus
Izena eman doan

Zure eskaera prozesatzen...

Transkripzio automatikoa. Ahoskatu etiketak, kapitulu-markatzaileak, SRT esportazioa.

Nola erabili Podcast transkribapena

1
Sartu zure sarrera

Idatzi testua, igo fitxategi bat edo deskribatu nahi duzuna. Ez da konturik behar.

2
Egin klik sortzean

Gure AI-ak zure eskaera segundotan prozesatzen du, kode irekiko eredurik onenak erabiliz.

3
Deskargatu eta partekatu

Deskargatu, kopiatu edo partekatu zure emaitza. Dohainik erabilpen pertsonal eta komertzialerako.

Erabili tresna hau API bidez

Automatizatu tresna hau zure kodetik. OpenAI-rekin bateragarria den REST amaiera-puntua, Bearer-token autentifikazioa, ez da SDK gehigarririk behar. Tokenen kostuak web interfazearekin bat datoz.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"file": "@audio.mp3", "language": "auto"}'

Podcast transkribapena - FAQ

Podcast-aren tresnak ahots-diarizazioa eta kapitulu-markatzaileak erabiltzen ditu lehenespenez (isiltasun-tartearen detekzioa >2s), eta 2 GB-ra arteko fitxategi luzeak onartzen ditu. Irteerako formatua SRT + VTT da, erakusteko oharrak dituzten bideo-klipetarako, TXT soila blog-mezuetarako, eta JSON egituratua, txanda bakoitzeko denbora-zigiluekin + ahots-etiketak, Descript-en estiloko lan-fluxuetan editatzeko.

Fitxategi bakoitzeko 2 GB arte — gutxi gorabehera 14 orduko audio podcast bat 128 kbps MP3-n. Fitxategi luzeak zerbitzari-aldetik zatitu egiten dira erresilientzia hobetzeko; transkribapen bateratu bakarra jasotzen duzu.

Bai. Ahoskatzen duenaren diarismoa aktibatuta dago lehenespenez. 2- 10 ahots ezberdin detektatzen ditugu ECAPA ahots kapsulazioen bidez, 1. / 2. /... ahoskatzen duten etiketa jartzen diegu eta etiketak aplikatzen dizkiogu segmentu bakoitzari. Izena aldatu diezaiekezu emaitzen ikuspegian.

Isiluneak 2 segundo baino luzeagoak dira — podcast-ek segmentuen artean erabiltzen dituzten etenaldi naturalak. Kapitulu bakoitzak denbora-zigilu bat du, zuzenean zure show-oharretan itsatsi dezakezuna YouTube + Spotify-ren "Chapters:" blokearekin.

Descript-ek $15-$30 kobratzen ditu hilean 10 orduko transkribapenerako, editoreari lotuta. Whisper-en, erabilera bakoitzeko ~500 token/min kobratzen ditugu ($5 = 200K token = ~400 minutu), harpidetzarik gabe, esportazio soila, nonnahi itsatsi daitekeena.

Riverside grabazio-estudio bat da, zure saioak doan transkribatzen dituena bere aplikazioan, baina haiekin grabatu ondoren bakarrik. Edozein MP3/WAV/MP4 transkribatzen dugu, non grabatu den kontuan hartu gabe.

Otter-ek 300 minutuko muga du hilean doako mailan, eta ingelesez dago zentratua. 99 hizkuntza onartzen ditugu Whisper-large-v3 zehaztasun berean, hileko mugarik gabe — transkribatutako minutu bakoitzeko ordaintzen duzu.

Bai — hautatu SRT edo WebVTT irteerako formatua bezala. Ahoskatzen dutenen etiketak lerroan sartuta daude (SRT) edo <v Speaker N> etiketa gisa (VTT), eta erreproduzitzaile moderno gehienek zuzen errendatzen dituzte.

Whisper-large-v3-k musika-lekuak eta oihartzun arinak ondo kudeatzen ditu (hitzen errore-tasa tipikoa 3-7% da). Musika oso ozenak edo gainezkatze handiak zehaztasuna murrizten du. Kontsideratu /music/vocal-remover/ exekutatzea kopia batean lehenik, edo zure irekiera hotzak zatitzea.

Whisper-ek izen arrunt gehienak kudeatzen ditu, baina marka espezifikoen jargoiak post-edizio pasa bat behar dezake. ~30 minutuko atal batek normalean 5-10 marka/izen zuzenketa ditu eskuz aplikatzeko.

Igo itzazue hemen banaka, edo erabili gure /batch/ funtzioa saioa hasi ondoren denboraldi bat ilaran jartzeko. /api/-ko APIak POST /v1/stt/ ere onartzen du programa bidezko batch-a egiteko.

Ez. Igotako fitxategiak ezabatzen dira transkribapena amaitu ondoren. Zure transkribapena /account/ historian jartzen da deskargatzeko saioa hasita badago; erabiltzaile anonimoek 24 orduko partekatze-esteka bat jasotzen dute.

Izena eman doan — 30.000 token/egun

Sortu kontu librea

Ez da kreditu-txartelik behar

Nola baloratuko zenuke tresna hau?

Free.ai maite duzu?