Podcast-ի փոխանցում

Առևտրային օգտագործման համար 581 մոդելներ ջրային նշան չկա Չկա գրանցում
մոդել
+ GPT-5, Claude, Gemini
Տեղադրեք podcast-ի հատվածը և ստանալ մաքուր, խոսնակի կողմից նշված transcript-ը` ինքնաբերաբար հայտնաբերված գլուխների նշիչներով լռության բացերից։ 2 ԳԲ-ի չափ երկար ֆայլեր, 99 լեզու, Whisper-large-v3 ճշգրտություն։ Արտահանել որպես SRT/VTT Ձեր վիդեո podcast-ի համար, պարզ TXT ցուցադրման նշումների համար կամ JSON Descript-style աշխատանքային հոսքերում խմբագրելու համար։

Տեղադրեք ձեր podcast-ի հատվածը կամ սեղմեք ՝ ընթերցելու համար

MP3, WAV, M4A, OGG, MP4 — երկարատև հատվածները մինչև 2 ԳԲ

- - - -
Գլխավորի նշանները հաշվարկվում են հաճախորդի կողմից կտրվածքների բացերից և ավելացվում են ձայնագրությանը։ Տեղադրեք դրանք YouTube կամ Spotify նկարագրությունների մեջ այնպես, ինչպես կան։
Տոկեի գնահատականը այս կադրի համար
-
Podcast transcript-ը
Ավտոմատորեն հայտնաբերված գլուխներ

Ձեր podcast-ի փոխանցում...

Ձեռք բերել ընթացիկ էջը

Ընտրեք ձայնագրիչը

Ցույց տալ գրառումները մեկ տեղադրման մեջ

Տեղադրել հատվածը, ներբեռնել TXT-ն։ Հանդիսատեսի ազգանունները ներառված են, գլուխների ժամանակագրությունները պատրաստ են Spotify/YouTube-ի նկարագրության համար, բլոգի գրառումը գրվել է 4 ժամի փոխարեն 10 րոպեում։

Տեսահոլովակի ձայնագրություն

Էքսպորտ SRT կամ WebVTT ձայնագրություն ձայնագրիչի պիտակների հետ։ Դրան ուղղակիորեն տեղադրել Premiere, Final Cut կամ DaVinci Resolve ծրագրերում կամ տեղադրել YouTube տեսանյութի հետ միասին՝ ձայնագրության մեջ տակավին չկասկածելի վերնագրեր ավելացնելու համար։

Տեքստային սերիաների խմբագրում

JSON արտահանումը տալիս է յուրաքանչյուր բառի սկզբ/ավարտ ժամանակային նշանները։ Փոխանցում Descript, Reaper կամ յուրահատուկ աշխատանքային հոսք՝ խմբագրում տեքստը ցուցադրելով, փոխարենը ջնջելով։

Ինչպես է աշխատում podcast-ի թարգմանությունը

  1. Տեղադրեք ձեր երգը թողնելու գոտում — MP3, WAV, M4A, MP4, մինչև 2 ԳԲ։
  2. Չբացել ձայնագրողի պիտակները և գլխամասերի նշիչները (դրանք լռելյայն են)։ Ստեղծեք ելքի ձևաչափը։
  3. Մենք ստուգում ենք տևողությունը և գնում ենք այն մինչև որ դուք որևէ տոկոս վճարեք։ Կտտացրեք «Առաջարկ» կոճակը։
  4. Հեռացրեք TXT, SRT, VTT կամ JSON բովանդակությամբ ձայնագրությունը։ Գլխավոր մասի նշանները կտեղադրվեն աջից, պատրաստ են կպցնելու համար։

Free.ai podcast transcription vs Descript, Րիվերսայդ, Օթեր

Օգտագործված Free.ai Descript Riverside Otter.ai
ԳինPay-per-use ($0.003/min)$15-30/mo$19/mo$16.99/mo
Ֆայլի առավելագույն չափը2 GB5 GBTied to record session500 MB (varies)
Խոսողի դիարիզացիա
Ավտոմատ գլուխների նշումներ (լռության վրա հիմնված)Manual-Paid tier
SRT/VTT արտահանումPaid
Լեզուներ9922100+English-focused
Հանրային API--Limited
Մրցակիցների գները արտացոլում են 2026-ի հանրային ցուցակում նշված մակարդակները։ Ստուգեք յուրաքանչյուր մատակարարի ներկայիս պլանները։
Ավելի լայն ընտրանքներ
Արդյունք
Ցուցանիշները վերջանում են։ Ստացել ավելի շատ նշաններ
Ուզում եք ավելի լավ արդյունքներ ստանալ։ Ծրագրեր (GPT-5, Claude, Gemini) ապահովում է ավելի բարձր որակ. Տեսանյութ

❤️ Սիրում ես Free.ai-ը, ասա ընկերներիդ։

Գրանցվեք -ին, որպեսզի ստանա այցելուի հղում և 30,000 տոկոս յուրաքանչյուր ընկերից.

Ուզում եք ավելին։ Առանց վճարի գրանցվել: 30,000 tokens/day
Անվճար գրանցում

Ձեր խնդրանքը քննվում է...

Առաջարկեք podcast- ները տեքստի հետ AI- ի միջոցով անվճար։ Խոսողի պիտակներ, գլուխների նշումներ, SRT արտահանում։

Ինչպես օգտագործել Podcast-ի փոխանցում

1
Տեղադրել ձեր մուտքագրումը

Տեղադրեք տեքստը, ներբեռնեք ֆայլ կամ նկարագրեք ցանկալիը։ Հաշիվը պահանջվում չէ։

2
Ընտրեք ստեղծել

Մեր ինտելեկտուալ ունակությունները վայրկյանների ընթացքում կկատարեն ձեր խնդրանքը` օգտագործելով բաց կոդով լավագույն մոդելները։

3
Տեղադրել և կիսվել

Բեռնել, կպցնել կամ կիսվել արդյունքներով։ Ազատ է անձնական և առևտրային օգտագործման համար։

Օգտագործել այս գործիքը API-ի միջոցով

Ավտոմատացրեք այս գործիքը ձեր սեփական կոդից։ OpenAI-ի հետ համընկնող REST վերջնական կետը, Bearer-token auth, ոչ մի հավելյալ SDK պահանջվում է։ Token-ի արժեքը համապատասխանում է վեբ ինտերֆեյսին։

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"file": "@audio.mp3", "language": "auto"}'

Podcast-ի փոխանցում - FAQ

Podcast-ի գործիքը լրիվ սկզբունքով օգտագործում է խոսնակի օրացույցը և գլուխների նշանները (լռության-տարբերակի հայտնաբերում >2 վայրկյան) և աջակցում է երկար ֆայլերին մինչև 2 ԳԲ չափով։ Էքսպորտային ձևաչափերը ներառում են SRT + VTT ցուցադրման-հաշվետվությունների տեսահոլովակների համար, պարզ TXT բլոգի գրառումների համար և կառուցվածքավորված JSON-ը յուրաքանչյուր քայլի ժամանակային նշաններով + խոսնակի պիտակները Descript-ի կերպարով աշխատանքային հոսքերում խմբագրելու համար։

Ընդամենը 2 ԳԲ յուրաքանչյուր ֆայլի համար - մոտավորապես 14 ժամ տևողությամբ ձայնային podcast 128 kbps MP3-ով։ Ծանրաբեռնված ֆայլերը սերվերի կողմից բաժանվում են հատվածների՝ արագության ապահովման համար։ Դուք ստանում եք միացված միակ տեքստը։

Այո, լռելյայն ակտիվացված է ձայնագրման պրոցեսը։ Մենք հայտնաբերում ենք 2- 10 տարբեր ձայներ ECAPA ձայնային ներդրումների միջոցով, նշում ենք դրանք Speaker 1 / 2 /... և կիրառում ենք նշումները յուրաքանչյուր հատվածում։ Դուք կարող եք վերանվանել դրանք արդյունքների տեսքով։

Լռության ժամանակահատվածը 2 վայրկյանից ավելի երկար է, դա podcast- ների կողմից օգտագործվող բնական ընդմիջումն է հատվածների միջև։ Յուրաքանչյուր գլուխը ժամանակի նշում է ստանում, որը կարող եք տեղադրել ձեր ցուցադրության գրառումներում YouTube + Spotify- ի համար «Գլուխներ:» բլոկի միջոցով։

Descript-ը ամսական 15-30 դոլար է վճարում 10 ժամ տեքստի թարգմանության համար, որը կապված է խմբագրիչի հետ։ Մենք վճարում ենք ~500 token/minute Whisper-ի համար ($5 = 200K tokens = ~400 րոպե), առանց բաժանորդագրության, պարզ արտահանում, որը կարող եք տեղադրել ցանկացած տեղ։

Riverside-ը ձայնագրման ստուդիա է, որը անվճար վերամշակում է ձեր սեանսները իրենց ծրագրի մեջ, բայց միայն նրանց հետ ձայնագրելուց հետո։ Մենք վերամշակում ենք ցանկացած MP3/WAV/MP4 ֆայլ՝ անկախ նրանից, թե որտեղ է այն ձայնագրվել։

Otter-ը տարեկան 300 րոպե է սահմանում անվճար մակարդակով և կենտրոնացած է անգլերենի վրա։ Մենք աջակցում ենք 99 լեզուների նույն Whisper-large-v3 ճշգրտությամբ, առանց ամսական սահմանի՝ դուք վճարում եք րոպեական փոխանցման համար։

Այո - ընտրեք SRT կամ WebVTT ելքի ձևաչափը: Խոսնակի պիտակները ներառված են էջում (SRT) կամ որպես <v Speaker N> պիտակներ (VTT), որոնք ժամանակակից խաղացողների մեծամասնությունը ճիշտ են ցուցադրում:

Whisper-large-v3-ը լավ է կառավարում երաժշտական ձայնագրությունները և լուսավոր ձայնային ազդանշանները (տիպիսական բառային սխալների ցուցանիշը 3-7%): Շատ բարձր ձայնով երաժշտությունը կամ ծանր ձայնային ազդանշանները նվազեցնում են ճշգրտությունը: Կարող եք նախ /music/vocal-remover/ կոդը գործարկել կամ Ձեր cold opens-ը բաժանել:

Whisper-ը կառավարում է ամենատարածված անունները, բայց բրենդային ժարգոնը կարող է պահանջել հետխմբագրման անցում։ ~30 րոպեանոց սերիաները սովորաբար ունեն 5-10 բրենդային/անվան ճշգրտումներ, որոնք պետք է ձեռքով կատարվեն։

Տեղադրեք դրանք այստեղ մեկ առ մեկ, կամ օգտագործեք /batch/ հատկությունը, երբ մուտքագրվել եք, որպեսզի դասավորեք դրանք հերթով։ /api/ API-ն նաև ընդունում է POST /v1/stt/-ը ծրագրային դասավորման համար։

Ոչ։ Փոխադրված ֆայլերը ջնջվում են փոխանցման ավարտից հետո։ Ձեր փոխանցումը տեղադրվում է /account/ պատմություն բաժնում, եթե մուտքագրվել եք համակարգ, իսկ անանուն օգտվողները ստանում են 24 ժամվա կիսում ստանալու հղում։

Առանց վճարի գրանցվել: 30,000 tokens/day

Ընտրեք հաշիվ

Կրեդիտ քարտի կարիք չկա

Ինչպե՞ս կգնահատեք այս գործիքը։

Սիրում ես Free.ai-ը, ասա ընկերներիդ։