Podcast transkribapena

Erabilera komertziala Ados 581 modeloak Ur-markarik ez Ez da izena eman behar
Modeloa:
+ GPT-5, Claude, Gemini
Igo podcast-aren atal bat eta lortu transkribapen garbia, hizlariak etiketatutakoa, isiltasun-hutsuneetatik kapitulu-markatzaileak automatikoki detektatuta. Fitxategi luzeak, 2 GB-ra arte, 99 hizkuntza, Whisper-large-v3 zehaztasuna. Esportatu SRT/VTT gisa zure bideo-podcasterako, TXT soila erakusteko oharrak, edo JSON Descript-estiloko lan-fluxuetan editatzeko.

Arrastatu eta jaregin podcastaren atal bat, edo egin klik arakatzeko

MP3, WAV, M4A, OGG, MP4 — 2 GB-ra arteko atal luzeak

- - - -
Kapitulu-markatzaileak bezeroaren aldetik segmentu-hutsuneetatik kalkulatzen dira eta transkribapenari eransten zaizkio. Itsatsi YouTube edo Spotify-ren azalpenetan dagoen bezala.
Token estimazioa klip honentzako
-
Podcast-aren transkribapena
Autodetektatu kapituluak

Podcast-a transkribatzen...

Episodio luzeek minutu batzuk behar dituzte. Fitxa hau itxi dezakezu "postaz bidali amaitzean" aukera hautatuta badago.

Podcaster + show editoreentzat eraikia

Erakutsi oharrak itsaspen batean

Igo atal hau, deskargatu TXT. Hizlariaren etiketak lerroan, kapituluaren denbora-markak Spotify/YouTube deskribapenerako prest, blogeko artikulua 10 minututan idatzia 4 ordutan idatzi ordez.

Bideo podcastaren azpitituluak

Esportatu SRT edo WebVTT hizlari-etiketekin. Premiere, Final Cut edo DaVinci Resolve-n zuzenean jartzen ditu, edo YouTube bideoarekin batera igotzen du azpititulu garbiak lortzeko.

Testuan oinarritutako atal-edizioa

JSON esportazioak hitz bakoitza hasierako/amaierako ordu-zigiluekin ematen dizu. Descript, Reaper edo lan-fluxu pertsonalizatu batera bideratu - editatu testua nabarmenduz garbitu ordez.

Podcast-en transkribapena nola funtzionatzen duen

  1. Arrastatu zure atal bat jaregiteko eremura — MP3, WAV, M4A, MP4, 2 GB arte.
  2. Utzi ahots-etiketak eta kapitulu-markatzaileak piztuta (lehenetsiak dira). Hautatu irteera-formatua.
  3. Iraupena eta prezioa egiaztatzen ditugu tokenak gastatu aurretik. Egin klik Transkribatu botoian.
  4. Deskargatu ahoskari-etiketatutako TXT, SRT, VTT edo JSON. Kapitulu-markatzaileak alboan bidaltzen dira, itsatsita.

Free.ai podcast transkribapena vs Descript, Riverside, Otter

Eginkizuna Free.ai Descript Riverside Otter.ai
PrezioaPay-per-use ($0.003/min)$15-30/mo$19/mo$16.99/mo
Fitxategiaren tamaina maximoa2 GB5 GBTied to record session500 MB (varies)
Ahoskariaren diarizazioa
Auto- kapitulu-markatzaileak (isilpean oinarritua)Manual-Paid tier
SRT/VTT esportazioaPaid
Hizkuntzak9922100+English-focused
API publikoa--Limited
Lehiakideen prezioek 2026an publikoki zerrendatutako maila islatzen dute. Egiaztatu hornitzaile bakoitzaren egungo planak.
Aukerak aurreratuak
Emaitza
Token gutxi. Eskuratu token gehiago
Emaitza hobeak nahi dituzu? Premium modeloak (GPT-5, Claude, Gemini) kalitate handiagoa ematen dute. Ikusi planoak

❤️ Maite duzu Free.ai? Esan lagunei!

Izen ematea erreferentzia-esteka bat lortzeko eta 30.000 token lagun bakoitzeko irabazteko.

Gehiago nahi duzu? Izena eman doan: 30.000 token/egun
Izena eman doan

Zure eskaera prozesatzen...

Transkribatu podcastak testura AI-rekin doan. Ahoskari-etiketak, kapitulu-markatzaileak, SRT esportazioa.

Nola erabili Podcast transkribapena

1
Sartu zure sarrera

Idatzi testua, igo fitxategi bat edo deskribatu nahi duzuna. Ez da konturik behar.

2
Egin klik sortzean

Gure AI-ak zure eskaera segundotan prozesatzen du, kode irekiko eredu onenak erabiliz.

3
Deskargatu eta partekatu

Deskargatu, kopiatu edo partekatu zure emaitza. Dohainik erabilpen pertsonal eta komertzialerako.

Erabili tresna hau API bidez

Automatizatu tresna hau zure kodetik. OpenAI-rekin bateragarria den REST amaiera-puntua, Bearer-token autentifikazioa, ez da SDK gehigarririk behar. Tokenen kostuak web interfazearekin bat datoz.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"file": "@audio.mp3", "language": "auto"}'

Podcast transkribapena - FAQ

Podcast-aren tresnak ahots-diariza eta kapitulu-markatzaileak lehenespenez onartzen ditu (isiltasun-tartearen detektazioa >2s), eta 2 GB-ra arteko fitxategi luzeak onartzen ditu. Irteera-formatuek SRT + VTT erakusten dute ohar-bideoklipetarako, TXT soila blog-mezuetarako, eta JSON egituratua txanda bakoitzeko denbora-zigiluekin + ahots-etiketak Descript-en estiloko lan-fluxuetan editatzeko.

Fitxategi bakoitzeko 2 GB arte - gutxi gorabehera 14 orduko audio podcast bat 128 kbps MP3-n. Fitxategi luzeak zerbitzari-aldetik zatitu egiten dira erresilientzia hobetzeko; transkribapen bateratu bakarra jasotzen duzu.

Bai. Ahoskari-diarizazioa aktibatuta dago lehenespenez. ECAPA ahots-kapsulazioa erabiliz 2-10 ahots ezberdin detektatzen ditugu, 1. ahots-emailea / 2. ahots-emailea /... etiketa jartzen diegu eta etiketak segmentu bakoitzari aplikatzen dizkiogu. Emaitza-ikuspegian berrizenda ditzakezu.

Isilune-tarteak 2 segundo baino luzeagoak dira - podcast-ek segmentuen artean erabiltzen dituzten etenaldi naturalak. Kapitulu bakoitzak denbora-zigilu bat jasotzen du, zuzenean zure show-oharretan itsatsi dezakezuna YouTube + Spotify-ren "Chapters:" blokearekin.

Descript-ek $15-$30 kobratzen ditu hilean 10 orduko transkribapenerako, editoreari lotuta. Erabilera bakoitzeko ~500 token/min kobratzen ditugu Whisper-en ($5 = 200K token = ~400 minutu), harpidetzarik gabe, esportazio soila, nonnahi itsatsi daitekeena.

Riverside grabazio-studio bat da, zure saioak doan transkribatzen dituena bere aplikazioan, baina soilik haiekin grabatu ondoren. Edozein MP3/WAV/MP4 transkribatzen dugu, non grabatu den kontuan hartu gabe.

Otter-ek 300 minutuko muga du hilean doako mailan, eta ingelesez egiten du lan. 99 hizkuntza onartzen ditugu Whisper-large-v3 zehaztasun berdinean, hileko mugarik gabe - transkribatutako minutu bakoitzeko ordaintzen duzu.

Bai - hautatu SRT edo WebVTT irteerako formatua bezala. Ahots-etiketak lerroan sartuta daude (SRT) edo <v Speaker N> etiketa gisa (VTT), eta erreproduzitzaile moderno gehienek zuzen errendatzen dituzte.

Whisper-large-v3-k musika-lekuak eta oihartzun arinak ondo kudeatzen ditu (hitz-errore-tasa tipikoa 3-7 da). Musika oso ozen batek edo gainezkatze handiak zehaztasuna murrizten du - pentsatu /music/vocal-remover/ kopia batean exekutatzen lehenik, edo zure irekiera hotzak zatitzea.

Whisper-ek izen arruntenak kudeatzen ditu, baina marka espezifikoen jargoiak edizio osteko pasabidea behar dezake. ~30 minutuko atal batek normalean 5-10 marka/izen zuzenketa ditu eskuz aplikatzeko.

Igo hemen banaka, edo erabili gure /batch/ funtzioa saioa hasi ondoren denboraldi bat ilaran jartzeko. /api/-ko APIak POST /v1/stt/ ere onartzen du programa bidezko batch-a egiteko.

Ez. Igotako fitxategiak transkribapena amaitu ondoren ezabatu egiten dira. Transkribapena zure /account/ historian jartzen da deskargatzeko saioa hasita badago; erabiltzaile anonimoak 24 orduko partekatze-esteka bat jasotzen dute.

Izena eman doan: 30.000 token/egun

Sortu kontu librea

Ez da kreditu-txartelik behar

Nola baloratuko zenuke tresna hau?

Maite duzu Free.ai? Esan lagunei!