Free ຊວາຮີລິ Transcription
ແປສຽງແລະວິດີໂອ ຊວາຮີລິ ໄປເປັນຂໍ້ຄວາມກັບ AI. ໄວ, ຖືກຕ້ອງແລະຟຣີ.
ວິທີການເຮັດວຽກ
- ໄປທີ່ កម្មវិធីແປສຽງ Free.ai
- ສົ່ງໄຟລ໌ສຽງ ຫຼື ວີດີໂອ ຊວາຮີລິ ຂອງທ່ານ
- AI ຂອງພວກເຮົາກວດພົບ ຊວາຮີລິ ໂດຍອັດຕະໂນມັດແລະແປມັນ
- ດາວໂຫລດບົດບັນທຶກຂອງທ່ານເປັນບົດຄວາມ ຫຼື ບົດລາຍຊື່ຜູ້ອ່ານ SRT
ຊວາຮີລິ ຄຸນສົມບັດການແປເປັນພາສາອັງກິດ
- ✓ພັດທະນາໂດຍ faster-whisper (ມີໃບອະນຸຍາດ MIT)
- ✓ການກວດພົບພາສາ ຊວາຮີລິ ໂດຍອັດຕະໂນມັດ
- ✓ສະຫນັບສະຫນູນ MP3, WAV, MP4, M4A, FLAC, ແລະອື່ນໆ
- ✓ສົ່ງອອກຊື່ບົດຄວາມພາຍໃຕ້ຊື່ສຽງ (SRT)
- ✓ບໍ່ມີຂໍ້ຈຳກັດຂະໜາດໄຟລ໌ໃນແຜນທີ່ຈ່າຍ
- ✓ຄວາມເປັນສ່ວນຕົວ ແລະ ຄວາມປອດໄພ -- ໄຟລ໌ຈະຖືກລຶບຫຼັງຈາກທີ່ໄດ້ປະມວນຜົນ
ລາຍລະອຽດພາສາ
| ພາສາ | ຊວາຮີລິ |
| ລະຫັດ ISO | sw |
| ແບບແບບ AI | faster-whisper |
| ລາຄາ | ຟຣີ |
ພາສາອື່ນ
ເບິ່ງພາສາທັງໝົດຄໍາຖາມທີ່ຖາມເລື້ອຍໆ
ຊວາຮີລິ ແມ່ນພາສາທີ່ມີຊັບພະຍາກອນ ໜ້ອຍ ກວ່າ ສຳ ລັບ Whisper - ໃຫຍ່-v3-turbo ຕັ້ງຢູ່ເທິງ 25% ອັດຕາຄວາມຜິດພາດຂອງຄໍາ, ບາງຄັ້ງກໍ່ຢູ່ເທິງ. ບົດບັນທຶກແມ່ນມີປະໂຫຍດ ສຳ ລັບການຄົ້ນຫາແລະ gist ແຕ່ບໍ່ຄວນຖືກຖືວ່າເປັນການພິມອອກພ້ອມ. ຖ້າເຄື່ອງຈັກທີ່ມີຄວາມຖືກຕ້ອງສູງກວ່າສາມາດໃຊ້ໄດ້ ສຳ ລັບ ຊວາຮີລິ ພວກເຮົາສາຍມັນໂດຍອັດຕະໂນມັດ. (ລະດັບ D, over 25% word error rate ຕາມມາດຕະຖານ - ພວກເຮົາພິມເຜີຍແຜ່ລະດັບ WER ທີ່ຈິງໃຈກວ່າການໂຄສະນາຂາຍສິນຄ້າ)
ໂອ້ - ຊວາຮີລິ transcription ແຕ້ມຈາກ pool token ຂອງທ່ານຟຣີທຸກໆມື້ກ່ອນ. ສຽງຄ່າໃຊ້ຈ່າຍປະມານ 50 tokens ຕໍ່ນາທີ, ດັ່ງນັ້ນ pool ມື້ທີ່ບໍ່ລະບຸຊື່ປົກຄຸມບາງຊົ່ວໂມງຂອງສຽງໃນແຕ່ລະມື້. ລົງທະບຽນໃນບັນຊີໄດ້ຮັບໃຫຍ່ກວ່າ 30,000-token pool ທຸກໆມື້. ຜ່ານນັ້ນ, transcription ແມ່ນຈ່າຍ-ເປັນ-ທ່ານ-ໄປ, ກັບ token top-ups ຈາກ $1.
ຕົວອັກສອນ ຊວາຮີລິ ຈະຖືກສົ່ງຄືນເປັນ UTF-8 ມາດຕະຖານພ້ອມກັບການອັກສອນປົກກະຕິຂອງພາສາ.
MP3, WAV, M4A, FLAC, OGG, OPUS, ແລະ WEBM ແມ່ນໄດ້ຮັບການຍອມຮັບໂດຍກົງ. ສໍາລັບວິດີໂອ (MP4, MOV, MKV) ພວກເຮົາດຶງດູດສຽງດົນຕີ track ຂ້າງເຊີບເວີກ່ອນທີ່ຈະສົ່ງມັນໄປ Whisper - ທ່ານບໍ່ຈໍາເປັນຕ້ອງປ່ຽນແປງສິ່ງໃດແດ່ເອງ. pipeline ດຽວກັນບໍ່ວ່າຈະເປັນພາສາຕົ້ນຕໍ, ລວມທັງ ຊວາຮີລິ.
ບໍ່ມີຊື່ອັບໂຫລດກອບໃນປະມານ 500 MB ຕໍ່ໄຟລ໌. ເຂົ້າສູ່ລະບົບບັນຊີໄປເຖິງ2GB. ໄລຍະເວລາແມ່ນບໍ່ຈໍາກັດຫຍຸ້ງຍາກ - ໄຟລ໌ຍາວແມ່ນ chunked ໂດຍອັດຕະໂນມັດ (30 ວິນາທີກັບ overlap window) ແລະ stitch ຄືນໄປບ່ອນໃນ transcript ດຽວກັບ timestamps ຕໍ່ໄປ. ຫຼາຍຊົ່ວໂມງ ຊວາຮີລິ ການບັນທຶກ (podcasts, lectures ເຕັມ, ກອງປະຊຸມ) ເຮັດວຽກດີ.
ຍິນດີຕ້ອນຮັບ - speaker diarization ແມ່ນປິດໂດຍ default ສໍາລັບ transcript ທຸກໆ ຊວາຮີລິ. ຜົນໄດ້ຮັບແມ່ນ segmented ເປັນ Speaker 1 / Speaker2/ Speaker3ກັບ timestamps, ດັ່ງນັ້ນການສໍາພາດ, ກອງປະຊຸມປຶກສາຫາລື, ແລະ multi-party ປະຊຸມມາກັບຄືນມາມີស្លាກ. Diarization ແລ່ນໃນແບບທີ່ແຍກຕ່າງຫາກແລະເຮັດວຽກຄືກັນໃນທົ່ວພາສາທັງຫມົດທີ່ພວກເຮົາສະຫນັບສະຫນູນ.
ຍິນດີ - ປ້າຍ URL ເຂົ້າໄປໃນ / transcribe / youtube / ສໍາລັບ YouTube ຫຼື / transcribe / podcast / ສໍາລັບ podcast feeds (Apple, Spotify, RSS). ພວກເຮົາດາວໂຫລດສຽງ, ແລ່ນມັນຜ່ານ Whisper ກັບພາສາ=sw, ແລະກັບຄືນໄປບ່ອນ transcript ກັບ timestamps ແລະເຄື່ອງຫມາຍຜູ້ເວົ້າ. ເນື້ອໃນ ຊວາຮີລິ ປົກກະຕິ: WhatsApp ສຽງບັນທຶກ, YouTube vlogs, ແລະວິດີໂອສັ້ນ-ຮູບຮ່າງແມ່ນ ຊວາຮີລິ ວຽກທີ່ມັກທີ່ສຸດ - ປ້າຍ URL ເຂົ້າໄປໃນ / transcribe / youtube / ຫຼືອັບໂຫລດສຽງໂດຍກົງ.
Whisper ຄ່າໃຊ້ຈ່າຍປະມານ 50 tokens ຕໍ່ນາທີຂອງສຽງ, ດັ່ງນັ້ນການບັນທຶກຫນຶ່ງຊົ່ວໂມງແມ່ນ ~3,000 tokens. ຜູ້ໃຊ້ສ່ວນໃຫຍ່ບໍ່ເຄີຍໃຊ້ຈ່າຍຫຍັງ - ຫ້ອງນ້ໍາຟຣີທຸກໆມື້ຂອງ 30,000 tokens ປົກຄຸມຄລິບສັ້ນ, ຂໍ້ຄວາມສຽງ, ແລະ podcasts ຫນຶ່ງ-off. ນອກເຫນືອໄປຈາກມັນ, ການແປແມ່ນຈ່າຍ-ເປັນ-ທ່ານ-ໄປ, ທີ່ມີ token top-ups ຈາກ $1.
ຍິນດີ - ລະດັບ segment (ທຸກໆ ~ 10-30 ວິນາທີ) ແລະ ລະດັບຄໍາ ເວລາ stamps ແມ່ນມີ. ລະດັບຄໍາ ແມ່ນປັ໊ມເດີມສໍາລັບ VTT / SRT ສົ່ງອອກບົດຂຽນພາຍໃຕ້ດັ່ງນັ້ນບົດຂຽນ sync ເສັ້ນ-by-line. ຢູ່ໃນ API ຕັ້ງ timestamps=" ຄໍາ "ໃນຮ່າງກາຍຄໍາຮ້ອງຂໍ. ຕົວອັກສອນ ຊວາຮີລິ ຈະຖືກສົ່ງຄືນເປັນ UTF-8 ມາດຕະຖານພ້ອມກັບການອັກສອນປົກກະຕິຂອງພາສາ.
ຍິນດີ. POST ສຽງ (multipart/form-data, ຊື່ພື້ນທີ່ "ໄຟລ໌") ໄປ /v1/transcribe / ກັບພາສາ=sw - ຫຼືລົບພາຣາມິດພາສາເພື່ອໃຫ້ Whisper ກວດພົບອັດຕະໂນມັດ. ສົ່ງຄືນ JSON ກັບ transcript, segments, timestamps, ແລະ ແທັກຜູ້ເວົ້າ. ຄໍາແນະນໍາເຕັມແລະ SDK snippets ທີ່ /api /.
ຍິນດີ - ຫຼັງຈາກການແປພາສາສໍາເລັດ, ກົດແປຫຼືຕິດຂໍ້ຄວາມເຂົ້າໄປໃນ / translate /. ຊວາຮີລິ ຄູ່ກັບພາສາອື່ນໆທຸກຢ່າງທີ່ພວກເຮົາສະຫນັບສະຫນູນ (200+). ສໍາລັບກອງປະຊຸມນາທີປັ໊ບການແປຜ່ານ / summarize /; ສໍາລັບ dubbing ສົ່ງມັນໄປ / voice / tts / ເພື່ອສະແດງສຽງໃນພາສາເປົ້າຫມາຍ.
ການຝຶກອົບຮົມສຽງລົບຂອງ Whisper ຊ່ວຍໄດ້ໜ້ອຍຢູ່ໃນລະດັບນີ້ - ບັນຫາແມ່ນຈຳນວນສຽງທີ່ ຊວາຮີລິ Whisper ເຫັນໃນລະຫວ່າງການຝຶກອົບຮົມ, ບໍ່ແມ່ນສຽງລົບ. ສຽງສະຕູດິໂອທີ່ສະອາດຍັງສາມາດເອົາຊະນະສຽງລົບໄດ້, ແຕ່ທັງສອງຈະບໍ່ສາມາດບັນລຸຄວາມຖືກຕ້ອງທີ່ທ່ານຈະໄດ້ໃນພາສາທີ່ມີຊັບພະຍາກອນສູງໄດ້.ຖ້າວ່າ ບົດບັນທຶກ ບໍ່ສາມາດໃຊ້ໄດ້ ສົ່ງອີເມວ contact@free.ai ໄປພ້ອມກັບ ເອກະສານ - ພວກເຮົາ ຈະ ຈ່າຍຄືນ ຄ່າ ລິ້ງ ແລະ ເບິ່ງວ່າ ເຄື່ອງຈັກ ອື່ນ ໆ ຈະ ຈັດການ ສຽງຂອງທ່ານໄດ້ດີກວ່າ.