faster-whisper large-v3-turbo

Free.ai (self-hosted) · stt · ~500 Тоглоомын тэмдэгт minute

Аудио эсвэл видео файлыг буцаан байршуулах эсвэл URL-ийг доошоо байршуулах

~500 Тоглоомын тэмдэгт minute

faster-whisper large-v3-turbo нь a ярианаас текст рүү загвар нь OpenAI / SYSTRAN-ийн бүтээсэн. Хамгийн хүчтэй нь Accurate transcription. Free.ai GPU дээр өөрийн хосттой — таны өдөр тутмын токен нөөц (500 токен минут)-ийн эсрэг үнэгүй ажиллана. MIT - Free.ai дээр худалдааны зорилгоор ашиглах зөвшөөрөлтэй.

API- ээр ашиглах

OpenAI-тай нийцсэн REST API. түлхүүр үүсгэж, энэ загварыг секундэд дуудна.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"whisper","audio_url":"https://..."}'
Тохиргооны баримт бичиг API түлхүүрийг авах

Заримдаа асуудаг асуултууд

faster-whisper large-v3-turbo нь ярианы дууг текст болгон хөрвүүлдэг. MP3, WAV, M4A, эсвэл видео файлыг татаж аваад faster-whisper large-v3-turbo нь бүрэн хөрвүүлэлтийг, мөн сонголттой SRT/VTT субтитрийг цаг хугацааны тэмдэглэгээтэй нь буцаана.

faster-whisper large-v3-turbo handles dozens of languages - Whisper-family models cover 90+, others vary. Pick "auto-detect" or specify the language for highest accuracy.

Англи хэлний үгийн алдааны хувь нь цэвэр Англи хэлний аудиод 5- 10%, дуу чимээ ихтэй эсвэл өнгөлөг аудиод 10- 20% байдаг. Ижил бүтэцтэй том хувилбарууд хатуу үсэгний хувьд илүү сайн ажилладаг - дуу чимээ нь хатуу бол том хувилбарыг сонгоно.

Тийм ээ - бүх хэсгүүд эхлэх/ дуусах цагийг агуулдаг. SRT эсвэл VTT хэлбэрээр экспортлох ба цагийг шууд видеонд харуулна.

faster-whisper large-v3-turbo нь бидний GPU дээр өдөр тутмын үнэгүй нөөцтэй тэмцэж эхлэх ба дараа нь $5 → 200,000 үнэтэй токен ашиглана. минутанд ~500 токен ашиглана.

MP3, WAV, M4A, FLAC, OGG, мөн видео (MP4, MOV, WebM) - дууг татаж авна. Нэг өргөтгөлд 500 МБ хүртэл. Хэт урт файлууд? /audio/cut/ эсвэл /v1/stt/batch/ ашиглан хуваана.

Хөгжмийн зохиолчдын диариз нь тусгай дамжуулалт юм - /transcribe/ дээр "diarize" -ийг соль. faster-whisper large-v3-turbo нь бичлэгийг удирддаг; диариз нь бүрэлдэхүүн хэсгүүдийг дуучин 1 / дуучин 2/ гэх мэтээр тэмдэглэдэг.

Тийм - /batch/ аудио файлын хавтсыг хүлээн авдаг. Бүх бичлэгүүд /account/?tab=history-д ордог. Хавтсыг хадгалах API-г ашигла.

Тийм - дууны бичлэгийг "faster-whisper large-v3-turbo" загвартай /v1/stt/transcribe/ руу POST хийнэ. JSON текст + хэсгүүд + үгийн түвшний цаг хугацааны тэмдэглэгээг буцаана. /api/ нь бүрэн холбоостой.

Өөрийн сервертэй загварууд дууг GPU дээр хадгална; Premium нь DPA-тай дамжуулна. Хөгжмийн файлыг хуваалцах цонхны дараа устгадаг (24 цаг аннон, 7 хоног бүртгэлтэй). Бид таны оруулсан мэдээллийг ашиглахгүй.

Тийм ээ - Free.ai нь бичлэгийг бизнесийн зорилгоор ашиглах эрх олгодог. Та өөрийн өргөж авсан дууны эрхийг (өөрөө бичсэн, лицензтэй материал, эсвэл зөвшөөрөлтэй агуулга) авах хэрэгтэй.

Real-time factor is roughly 0.05-0.2× - a 60-minute podcast transcribes in 3-12 minutes. Premium models often finish faster. Use the queue button to close the tab.

Free.ai-ийг хайрладаг уу? Найзуудаа хэлж өгөөрэй!

Энэ хуудсыг үнэл