Distil-Whisper large-v3

Free.ai (self-hosted) · stt · ~500 žetoni minute

Nometiet audio vai video failu vai ielīmējiet URL zemāk

~500 žetoni minute

Distil-Whisper large-v3 ir a runas un teksta modelis, kas izgatavots ar HuggingFace. Aktivitāte pie Real-time transcription, large-volume batch STT.. Pašuzņēmums Free.ai GPU – brauc bez maksas pret jūsu ikdienas žetonu baseins (500 žetoni minūtē). Atbrīvo saskaņā ar MIT - komerciāla izmantošana atļauta uz Free.ai.

Izmantošana caur API

AtvērtAI savietojama REST API. Ģenerējiet atslēgu un zvaniet šo modeli sekundēs.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"distil-whisper-large-v3","audio_url":"https://..."}'
API dokumentācija Iegūst API atslēgu

Bieži uzdoti jautājumi

Distil-Whisper large-v3 tranraksti skaļi audio tekstā. Ielādējiet MP3, WAV, M4A vai video failu un Distil-Whisper large-v3 atgriež pilnu transkriptu plus izvēles SRT/VTT subtitrus ar laika zīmogiem.

Distil-Whisper large-v3 handles dozens of languages - Whisper-family models cover 90+, others vary. Pick "auto-detect" or specify the language for highest accuracy.

Vārdu kļūdu ātrums ir 5-10% uz tīra angļu audio, 10-20% uz trokšņains vai izcelts audio. Lieli varianti tās pašas arhitektūras darīt nozīmīgi labāk par grūtiem gadījumiem - izvēlieties lielāku, ja audio ir raupja.

Jā - katrs segments ietver start/end laika zīmjus. Eksportēt kā SRT vai VTT un laika karti tieši uz jūsu video.

Distil-Whisper large-v3 darbojas uz mūsu pašu GPU pret jūsu ikdienas bezmaksas baseins vispirms; $5 → 200,000 maksā žetoni pēc tam. Par ~500 žetoni minūtē.

MP3, WAV, M4A, FLAC, OGG, plus video (MP4, MOV, WebM) - mēs izvelkam audio. Maksimāli 500 MB uz augšupielādi. Ilgāki faili? Sadalīti ar /audio/cut/ vai izmantot /v1/stt/partch/.

Garsētājs diarizācija ir atsevišķa caurlaide - toggle "dializēt" uz / transkripcijas /. Distil-Whisper large-v3 apstrādā transkripciju; Diarizēšanas etiķetes katram segmentam ar skaļruņu 1 / Skaļruņu 2 / uc

Jā - /partch/ pieņem audio failu mapi. Katra transkripcijas laukuma /konta/?tab=vēsture ar oriģinālo faila nosaukumu. Mapju- koku saglabāšanai izmantojiet API.

Jā - Ievieto audio uz /v1/stt/ transparent/ ar modeli="Distil-Whisper large-v3". Atgriež JSON ar tekstu + segmentiem + vārda līmeņa rakstzīmes. /api/ ir pilna atsauce.

Pašuzturēti modeļi saglabāt audio par mūsu GPU; premium iet cauri ar DPA. Audio tiek dzēsts pēc akcijas-vindow (24h anon, 7d pierakstīšanās). Mēs nemācāmies uz jūsu ievades.

Jā - Free.ai piešķir transkriptu komerciālu izmantošanu. Jums ir nepieciešamas tiesības uz jūsu augšupielādēto audio (savu ierakstu, licencēto materiālu vai saturu ar piekrišanu).

Reālā laika faktors ir aptuveni 0,05-0,2× - 60 minūšu podcast transkripcijas transkripcijas 3-12 minūšu laikā. Premium modeļi bieži vien beidzas ātrāk. Izmantojiet rindas pogu, lai aizvērtu cilni.

Mīlestība Free.ai? Stāsti saviem draugiem!

Novērtēt šo lapu