казах чөлөөт орчуулга
казах аудио болон видеог AI-ээр текст болгон хөрвүүл. Хурдан, үнэн зөв, үнэгүй.
Яаж ажилладаг вэ
- Дараагийн хуудас Free.ai Хувилбарлагч
- Таны казах аудио эсвэл видео файлыг өргөх
- Бидний хиймэл оюун ухаан казах-ийг автоматаар олж, бичиж өгнө
- Таны бичлэгийг текст эсвэл SRT субтитр болгон татаж авна
казах-ийн хөрвүүлэлтийн онцлог
- ✓faster-whisper-ээр дэмжигдсэн (MIT лицензтэй)
- ✓Автомат казах хэлний олж илрүүлэх
- ✓MP3, WAV, MP4, M4A, FLAC, болон бусад форматуудыг дэмждэг
- ✓Үеийн тэмдэглэл ба субтитр экспортлох (SRT)
- ✓Нэмэлт файлын хэмжээ
- ✓Хувийн ба аюулгүй -- файлууд боловсруулсны дараа устгагдана
Тоглоомын мэдээ
| Хэл | казах |
| ISO код | kk |
| AI загвар | faster-whisper |
| Үнэ | Хязгааргүй |
Өөр хэл
Бүх хэлийг харахТодорхой асуултууд
казах нь Whisper-ийн хувьд бага нөөцтэй хэл юм - том-v3-турбо нь 25% -ийн үгийн алдааны түвшинтэй, заримдаа бүр түүнээс ч илүү. Энэ бичлэг нь хайлт болон сэдэвчилсэн мэдээллийн хувьд ашигтай боловч хэвлэхэд бэлэн гэж тооцогдохгүй. Хэрэв казах-д илүү нарийвчлалтай хөдөлгүүр байгаа бол бид үүнийг автоматаар оруулна. (Tier D, over 25% word error rate on benchmark sets - we publish honest WER tiers rather than marketing claims.)
Тийм ээ - казах-ийн бичлэг нь эхлээд таны өдөр тутмын үнэгүй токенуудын сангаас авдаг. Хөгжим минутанд 50 токен зарцуулдаг тул өдөр тутмын нууцлаг сан нь өдөрт хэдэн цагийн дууг багтаадаг. Нэвтрсэн хэрэглэгчид өдөр бүр 30,000 токенийн сантай. Үүнээс гадна бичлэг нь $1-ээс эхлэн төлбөртэй байдаг.
казах транскрипц нь стандарт UTF- 8- ээр хэлний хэвийн үсэг бичлэгтэй эргэж ирнэ.
MP3, WAV, M4A, FLAC, OGG, OPUS, WEBM форматууд шууд хүлээн авагдана. Видео (MP4, MOV, MKV)- ийн хувьд серверийн талд дууны бичлэгийг Whisper руу илгээхдээ татаж авдаг - та өөртөө юу ч өөрчлөх шаардлагагүй. Эх үүсвэр хэлнээс үл хамааран, казах- ийг ч хамруулан, ижил хоолой ашиглана.
Анноним өргөтгөлийн хэмжээ нь файл бүрт 500 MB-аас хэтрэхгүй. Нэвтрсэн хэрэглэгчид 2GB хүртэлх хэмжээтэй өргөтгөлийг өргөж болно. Энэ нь хатуу хязгаарлалт биш - урт файлууд автоматаар хэсэгчлэн хуваагддаг (30 секундын дэлгэц хоорондоо давхцаж) ба үргэлжилсэн цаг хугацааны тэмдэглэлтэй нэг файлд нэгтгэдэг. Олон цагийн казах бичлэгүүд (подкаст, бүрэн лекц, уулзалт) сайн ажилладаг.
Зүгээр - зказах- ийн бүх бичлэгийн хувьд яригчдын диаристикийг урьдчилан тохируулсан. Үр дүн нь яригч 1 / яригч 2/ яригч 3- ийн хооронд хуваагддаг бөгөөд цаг хугацааны тэмдэглэгээтэй байдаг тул ярилцлага, хэлэлцүүлэг, олон талт уулзалтууд тэмдэглэгдсэн байдаг. Диаристик нь өөр загвар дээр ажилладаг бөгөөд бидний дэмждэг бүх хэл дээр адилхан ажилладаг.
Тийм — URL-ийг YouTube-ийн хувьд /transcribe/youtube/, подкастын (Apple, Spotify, RSS) хувьд /transcribe/podcast/ руу оруулах. Аудиог татаж аваад, хэл=kk-тэй Whisper-ээр дамжуулан, цаг хугацааны тэмдэглэгээ болон яригчдын тэмдэглэгээтэй хамт буцаана. казах-ийн нийтлэг агуулга: лекц, ярилцлага, дууны тэмдэглэл, YouTube-ийн агуулга казах-д бүгд ажиллана - URL-ийг /transcribe/youtube/ руу оруулах эсвэл шууд файлыг өргөтгөх.
Whisper costs about 50 tokens per minute of audio, so a one-hour recording is ~3,000 tokens. Most users never spend anything - the free daily pool of 30,000 tokens covers short clips, voice notes, and one-off podcasts. Beyond it, transcription is pay-as-you-go, with token top-ups from $1.
Тийм ээ - хэсэг түвшний (~10-30 секунд тутамд) болон үгийн түвшний цаг хугацааны тэмдэглэгээнүүд байдаг. VTT/SRT-ийн субтитр экспортлохдоо үгийн түвшин нь хэвийн бөгөөд ингэснээр мөр бүрийн дор бичлэгийг синхрончлох боломжтой. API дээр хүсэлтийн биед timestamps="word"-ийг тохируулна. казах транскрипц нь стандарт UTF- 8- ээр хэлний хэвийн үсэг бичлэгтэй эргэж ирнэ.
Тийм. POST аудио (multipart/form-data, field name "file")-г /v1/transcribe/ руу language=kk - эсвэл Whisper-г автоматаар олж авахын тулд хэлний параметрийг хасна. JSON-г бичлэг, хэсгүүд, цаг, дуу хоолойн тэмдэгтүүдтэй нь буцаана. Бүх холбоос болон SDK-ийн хэсгүүд /api/-д байна.
Тийм ээ - бичлэг дууссаны дараа "Түлхүүр" товчийг дарж эсвэл текстийг /translate/ рүү байрлуулна. казах нь бидний дэмждэг бүх хэл (200+) -тэй хослодог. Хурлын тэмдэглэлүүд нь бичлэгийг /summarize/ -ээр дамжуулдаг; дуу оруулах нь /voice/tts/ -д дууг нь эх хэл дээр нь гаргахад ашигладаг.
Whisper- ийн чимээ сургах нь энэ түвшинд бага тусалдаг - чимээ биш зказах- ийн чимээ Whisper- ийн сургах үед үзсэн хэмжээ нь саад болдог. Цэвэр студи дуу чимээ чимээтэй дууг илүү сайн давдаг, гэхдээ өндөр эх үүсвэртэй хэл дээр авах боломжтой хэмжилтийг олж чадахгүй.Хэрэв бичлэг ашиглагдахгүй бол contact@free.ai хаягаар файлыг илгээх - бид таны токеныг буцааж өгөх бөгөөд өөр мотор таны аудиог илүү сайн боловсруулж чадах эсэхийг шалгана.