ёруба чөлөөт орчуулга

ёруба аудио болон видеог AI-ээр текст болгон хөрвүүл. Хурдан, үнэн зөв, үнэгүй.

Яаж ажилладаг вэ

  1. Дараагийн хуудас Free.ai Хувилбарлагч
  2. Таны ёруба аудио эсвэл видео файлыг өргөх
  3. Бидний хиймэл оюун ухаан ёруба-ийг автоматаар олж, бичиж өгнө
  4. Таны бичлэгийг текст эсвэл SRT субтитр болгон татаж авна

ёруба-ийн хөрвүүлэлтийн онцлог

  • ✓faster-whisper-ээр дэмжигдсэн (MIT лицензтэй)
  • ✓Автомат ёруба хэлний олж илрүүлэх
  • ✓MP3, WAV, MP4, M4A, FLAC, болон бусад форматуудыг дэмждэг
  • ✓Үеийн тэмдэглэл ба субтитр экспортлох (SRT)
  • ✓Нэмэлт файлын хэмжээ
  • ✓Хувийн ба аюулгүй -- файлууд боловсруулсны дараа устгагдана

Тоглоомын мэдээ

Хэлёруба
ISO кодyo
AI загварfaster-whisper
ҮнэХязгааргүй

Тодорхой асуултууд

ёруба нь Whisper-ийн хувьд бага нөөцтэй хэл юм - том-v3-турбо нь 25% -ийн үгийн алдааны түвшинтэй, заримдаа бүр түүнээс ч илүү. Энэ бичлэг нь хайлт болон сэдэвчилсэн мэдээллийн хувьд ашигтай боловч хэвлэхэд бэлэн гэж тооцогдохгүй. Хэрэв ёруба-д илүү нарийвчлалтай хөдөлгүүр байгаа бол бид үүнийг автоматаар оруулна. (Tier D, over 25% word error rate on benchmark sets - we publish honest WER tiers rather than marketing claims.)

Тийм ээ - ёруба-ийн бичлэг нь эхлээд таны өдөр тутмын үнэгүй токенуудын сангаас авдаг. Хөгжим минутанд 50 токен зарцуулдаг тул өдөр тутмын нууцлаг сан нь өдөрт хэдэн цагийн дууг багтаадаг. Нэвтрсэн хэрэглэгчид өдөр бүр 30,000 токенийн сантай. Үүнээс гадна бичлэг нь $1-ээс эхлэн төлбөртэй байдаг.

ёруба транскрипц нь стандарт UTF- 8- ээр хэлний хэвийн үсэг бичлэгтэй эргэж ирнэ.

MP3, WAV, M4A, FLAC, OGG, OPUS, WEBM форматууд шууд хүлээн авагдана. Видео (MP4, MOV, MKV)- ийн хувьд серверийн талд дууны бичлэгийг Whisper руу илгээхдээ татаж авдаг - та өөртөө юу ч өөрчлөх шаардлагагүй. Эх үүсвэр хэлнээс үл хамааран, ёруба- ийг ч хамруулан, ижил хоолой ашиглана.

Анноним өргөтгөлийн хэмжээ нь файл бүрт 500 MB-аас хэтрэхгүй. Нэвтрсэн хэрэглэгчид 2GB хүртэлх хэмжээтэй өргөтгөлийг өргөж болно. Энэ нь хатуу хязгаарлалт биш - урт файлууд автоматаар хэсэгчлэн хуваагддаг (30 секундын дэлгэц хоорондоо давхцаж) ба үргэлжилсэн цаг хугацааны тэмдэглэлтэй нэг файлд нэгтгэдэг. Олон цагийн ёруба бичлэгүүд (подкаст, бүрэн лекц, уулзалт) сайн ажилладаг.

Зүгээр - зёруба- ийн бүх бичлэгийн хувьд яригчдын диаристикийг урьдчилан тохируулсан. Үр дүн нь яригч 1 / яригч 2/ яригч 3- ийн хооронд хуваагддаг бөгөөд цаг хугацааны тэмдэглэгээтэй байдаг тул ярилцлага, хэлэлцүүлэг, олон талт уулзалтууд тэмдэглэгдсэн байдаг. Диаристик нь өөр загвар дээр ажилладаг бөгөөд бидний дэмждэг бүх хэл дээр адилхан ажилладаг.

Тийм — URL-ийг YouTube-ийн хувьд /transcribe/youtube/, подкастын (Apple, Spotify, RSS) хувьд /transcribe/podcast/ руу оруулах. Аудиог татаж аваад, хэл=yo-тэй Whisper-ээр дамжуулан, цаг хугацааны тэмдэглэгээ болон яригчдын тэмдэглэгээтэй хамт буцаана. ёруба-ийн нийтлэг агуулга: лекц, ярилцлага, дууны тэмдэглэл, YouTube-ийн агуулга ёруба-д бүгд ажиллана - URL-ийг /transcribe/youtube/ руу оруулах эсвэл шууд файлыг өргөтгөх.

Whisper costs about 50 tokens per minute of audio, so a one-hour recording is ~3,000 tokens. Most users never spend anything - the free daily pool of 30,000 tokens covers short clips, voice notes, and one-off podcasts. Beyond it, transcription is pay-as-you-go, with token top-ups from $1.

Тийм ээ - хэсэг түвшний (~10-30 секунд тутамд) болон үгийн түвшний цаг хугацааны тэмдэглэгээнүүд байдаг. VTT/SRT-ийн субтитр экспортлохдоо үгийн түвшин нь хэвийн бөгөөд ингэснээр мөр бүрийн дор бичлэгийг синхрончлох боломжтой. API дээр хүсэлтийн биед timestamps="word"-ийг тохируулна. ёруба транскрипц нь стандарт UTF- 8- ээр хэлний хэвийн үсэг бичлэгтэй эргэж ирнэ.

Тийм. POST аудио (multipart/form-data, field name "file")-г /v1/transcribe/ руу language=yo - эсвэл Whisper-г автоматаар олж авахын тулд хэлний параметрийг хасна. JSON-г бичлэг, хэсгүүд, цаг, дуу хоолойн тэмдэгтүүдтэй нь буцаана. Бүх холбоос болон SDK-ийн хэсгүүд /api/-д байна.

Тийм ээ - бичлэг дууссаны дараа "Түлхүүр" товчийг дарж эсвэл текстийг /translate/ рүү байрлуулна. ёруба нь бидний дэмждэг бүх хэл (200+) -тэй хослодог. Хурлын тэмдэглэлүүд нь бичлэгийг /summarize/ -ээр дамжуулдаг; дуу оруулах нь /voice/tts/ -д дууг нь эх хэл дээр нь гаргахад ашигладаг.

Whisper- ийн чимээ сургах нь энэ түвшинд бага тусалдаг - чимээ биш зёруба- ийн чимээ Whisper- ийн сургах үед үзсэн хэмжээ нь саад болдог. Цэвэр студи дуу чимээ чимээтэй дууг илүү сайн давдаг, гэхдээ өндөр эх үүсвэртэй хэл дээр авах боломжтой хэмжилтийг олж чадахгүй.Хэрэв бичлэг ашиглагдахгүй бол contact@free.ai хаягаар файлыг илгээх - бид таны токеныг буцааж өгөх бөгөөд өөр мотор таны аудиог илүү сайн боловсруулж чадах эсэхийг шалгана.

Free.ai-ийг хайрладаг уу? Найзуудаа хэлж өгөөрэй!

Энэ хуудсыг үнэл