I-isiSwahili yokudlulisa
Bhala isiSwahili umsindo nevidiyo ube ngumbhalo nge-AI. Ishesha, ilungile, futhi imahhala.
Indlela esebenza ngayo
- Iya ku- Umshicileli we-Free.ai
- Layisha phezulu ihele lakho le-isiSwahili lomsindo noma levidiyo
- I-AI yethu ithola ngokuzenzakalela i-isiSwahili futhi ibhalela
- Layisha ngezansi incwadi yakho njengesihloko noma isizinda se-SRT
isiSwahili Izici zokudlulisa
- ✓Isebenza nge faster-whisper (ilayisense le-MIT)
- ✓Ukuthola ulwimi isiSwahili ngokuzenzakalela
- ✓Isekela i-MP3, i-WAV, i-MP4, i-M4A, i-FLAC, nezinye
- ✓Ama-timestamps kanye ne-subtitle export (SRT)
- ✓Akukho kuphikiswa kwesayizi yefayela kuma-plans akhokhelwayo
- ✓Imfihlo nokuphepha -- amafayela asuswa ngemuva kokusebenza
Iminingwane yesilimi
| Ilimi | isiSwahili |
| Ikhodi ISO | sw |
| Imodeli AI | faster-whisper |
| Intengo | Ikhululekile |
Izilimi Eziningi
Bona zonke izilimiImibuzo ebuzwa kaningi
isiSwahili iyisilimi esincane-somthombo se-Whisper — i-large-v3-turbo ihlala ngaphezu kwe-25% yezinga lephutha legama, ngamanye amaxesha liphezulu kakhulu. I-transcript isebenza ukukhangela nokwenza i-gist kodwa akufanele ithathwe njengeshicilelwa-kulungile. Uma i-engine esezingeni eliphakeme itholakala ku-isiSwahili siyibeka ngokuzenzakalela.(I-Tier D, over 25% word error rate kusethingi se-benchmark — sishicilela ama-tiers we-WER athembekile ngaphezu kokuphikisana nokumaketha.)
Yebo — isiSwahili ukudluliswa kuqala kuvela ku-token pool yakho yansuku zonke. Umsindo ubiza ama-token angama-50 ngomzuzu, ngakho-ke i-token pool engaziwayo ihlanganisa amahora ambalwa we-audio ngosuku. Ama-akhawunti abhalisiwe athola u-token pool omkhulu wama-30,000 ngosuku. Ngaphakathi, ukudluliswa kwenziwa ngemali-njengoba-uhamba, nge-token top-ups kusuka ku-$1.
isiSwahili izixhumanisi zibuyiselwa ku UTF-8 ejwayelekile nge-ortography ejwayelekile yesilimi.
MP3, WAV, M4A, FLAC, OGG, OPUS, ne WEBM zivunyelwe ngokuqondile. Ngevidiyo (MP4, MOV, MKV) sikhipha umsindo we-server-side ngaphambi kokuthunyelwa ku-Whisper — awudingi ukushintsha noma yini ngokwakho. Ipayipi elifanayo ngaphandle komthombo we-language, kufaka phakathi i-isiSwahili.
Ukufaka okungenagama kufinyelela kuma-500 MB ngefayela ngalinye. Ama-akhawunti abhalisiwe afinyelela ku-2 GB. Ukuphela kwesikhathi akuyona umkhawulo onzima - amafayela ade ahlukaniswa ngokuzenzakalela (amafasitela emizuzu engu-30 ahlukaniswe) futhi aphinde ahlukaniswe ibe yi-transcript eyodwa nesikhathi esiqhubekayo. Ukurekhodwa kwehora eliningi isiSwahili (amapodcasts, izifundo ezigcwele, izinhlanganiso) kusebenza kahle.
Yebo — ukudweba umsindo komsindo kusetshenzisiwe ngokuzenzakalela kuwo wonke ama-isiSwahili transcript. I-output ihlukaniswe njenge-Speaker 1 / Speaker 2 / Speaker 3 nge-timestamps, ngakho-ke izingqungquthela, izingqungquthela zepaneli, nezingqungquthela zeqembu eliningi zibuyela emuva zinikezwe i-label. Ukudweba umsindo kusebenza ngemodeli ehlukile futhi kusebenza ngokufanayo kuwo wonke ama-languages esiwaxhasayo.
Yebo — chofoza i-URL ku /transcribe/youtube/ ye-YouTube noma /transcribe/podcast/ ye-podcast feeds (Apple, Spotify, RSS). Silanda umsindo, siwuqhube nge-Whisper nge-language=sw, futhi sibuyisele i-transcript nge-timestamps ne-speaker labels. I-isiSwahili ejwayelekile: I-WhatsApp voice notes, i-YouTube vlogs, nevidiyo encane yizinto ezivame kakhulu isiSwahili workloads — chofoza i-URL ku /transcribe/youtube/ noma ulayishe umsindo ngqo.
Whisper ibiza ama-token angama-50 ngomzuzu wokudlalwa kwesandi, ngakho-ke ukurekhoda kwehora elilodwa kubiza ama-token angama-~3,000. Abaningi abasebenzisayo abasebenzisi lutho — i-pool yamahhala yansuku zonke yama-token angama-30,000 ifaka ama-clip ancane, ama-notes omsindo, nama-podcasts afanayo. Ngaphesheya kwayo, ukudluliswa kwenziwa ngemali-njengoba-uhamba, nge-token top-ups kusuka ku-$1.
Yebo — zombili isigaba-sezinga (noma yikuphi ~10-30 imizuzwana) kanye negama-level timestamps zikhona. Igama-level yiphutha le-VTT/SRT subtitle export ngakho ama-captions asynchronize line-by-line. Kwi-API hlela timestamps="word" kwi-body yesicelo. isiSwahili izixhumanisi zibuyiselwa ku UTF-8 ejwayelekile nge-ortography ejwayelekile yesilimi.
Yebo. POST umsindo (ingxenye/ifomu-data, igama lendawo "ihele") ku /v1/transcribe/ nge lingu=sw — noma ushiye i parameter yesilimi ukuze i Whisper ikwazi ukukhomba ngokuzenzakalela. Ibuyisela i JSON nge lingu, amasegmenti, ama-timestamps, nama-speaker labels. Umbiko ophelele kanye ne-SDK snippets ku /api/.
Yebo — uma ukuguqulelwa kuqediwe, chofoza guqula noma chofoza umbhalo ku /guqula/. isiSwahili ixhumana nanoma iyiphi enye ulwimi esixhasayo (200+). Usuku lwengxoxo lidlulisa ukuguqulelwa /summarize/; ukuguqulelwa lithunyelwe ku /voice/tts/ ukuze kunikezwe umsindo kulimi oluzosetshenziswa.
Whisper's noise training helps less at this tier — the bottleneck is the amount of isiSwahili audio Whisper saw during training, not noise. Clean studio audio still beats noise audio, but neither will reach the accuracy you would get on a high-source language.Uma i-transcript ibuyela ingasebenzi, thumela i-imeyili ku contact@free.ai ngefayela — sizobuyisela imali ye-token futhi sibheke ukuthi ngabe i-engine eyahlukileyo iphatha umsindo wakho kahle.