Free ເກົາຫລີ Transcription
ແປສຽງແລະວິດີໂອ ເກົາຫລີ ໄປເປັນຂໍ້ຄວາມກັບ AI. ໄວ, ຖືກຕ້ອງແລະຟຣີ.
ວິທີການເຮັດວຽກ
- ໄປທີ່ កម្មវិធីແປສຽງ Free.ai
- ສົ່ງໄຟລ໌ສຽງ ຫຼື ວີດີໂອ ເກົາຫລີ ຂອງທ່ານ
- AI ຂອງພວກເຮົາກວດພົບ ເກົາຫລີ ໂດຍອັດຕະໂນມັດແລະແປມັນ
- ດາວໂຫລດບົດບັນທຶກຂອງທ່ານເປັນບົດຄວາມ ຫຼື ບົດລາຍຊື່ຜູ້ອ່ານ SRT
ເກົາຫລີ ຄຸນສົມບັດການແປເປັນພາສາອັງກິດ
- ✓ພັດທະນາໂດຍ faster-whisper (ມີໃບອະນຸຍາດ MIT)
- ✓ການກວດພົບພາສາ ເກົາຫລີ ໂດຍອັດຕະໂນມັດ
- ✓ສະຫນັບສະຫນູນ MP3, WAV, MP4, M4A, FLAC, ແລະອື່ນໆ
- ✓ສົ່ງອອກຊື່ບົດຄວາມພາຍໃຕ້ຊື່ສຽງ (SRT)
- ✓ບໍ່ມີຂໍ້ຈຳກັດຂະໜາດໄຟລ໌ໃນແຜນທີ່ຈ່າຍ
- ✓ຄວາມເປັນສ່ວນຕົວ ແລະ ຄວາມປອດໄພ -- ໄຟລ໌ຈະຖືກລຶບຫຼັງຈາກທີ່ໄດ້ປະມວນຜົນ
ລາຍລະອຽດພາສາ
| ພາສາ | ເກົາຫລີ |
| ລະຫັດ ISO | ko |
| ແບບແບບ AI | faster-whisper |
| ລາຄາ | ຟຣີ |
ພາສາອື່ນ
ເບິ່ງພາສາທັງໝົດຄໍາຖາມທີ່ຖາມເລື້ອຍໆ
Whisper ໃຫຍ່-v3-turbo ດິນໃນລະດັບຄວາມຖືກຕ້ອງສູງສຸດຂອງຕົນກ່ຽວກັບ ເກົາຫລີ - ຕ່ໍາກວ່າ 7% ອັດຕາຄວາມຜິດພາດຄໍາເວົ້າກ່ຽວກັບມາດຕະຖານ benchmarks. ໃນການປະຕິບັດທີ່ຫມາຍຄວາມວ່າສຽງສະຕູດິໂອສະອາດມາກັບຄືນໃກ້-ສົມບູນແບບ, ແລະສຽງສົນທະນາແມ່ນໃຊ້ໄດ້ກັບການລ້າງຢ່າງຫນ້ອຍ. (ລະດັບ A, under 7% word error rate ຕາມມາດຕະຖານ - ພວກເຮົາພິມເຜີຍແຜ່ລະດັບ WER ທີ່ຈິງໃຈກວ່າການໂຄສະນາຂາຍສິນຄ້າ)
ໂອ້ - ເກົາຫລີ transcription ແຕ້ມຈາກ pool token ຂອງທ່ານຟຣີທຸກໆມື້ກ່ອນ. ສຽງຄ່າໃຊ້ຈ່າຍປະມານ 50 tokens ຕໍ່ນາທີ, ດັ່ງນັ້ນ pool ມື້ທີ່ບໍ່ລະບຸຊື່ປົກຄຸມບາງຊົ່ວໂມງຂອງສຽງໃນແຕ່ລະມື້. ລົງທະບຽນໃນບັນຊີໄດ້ຮັບໃຫຍ່ກວ່າ 30,000-token pool ທຸກໆມື້. ຜ່ານນັ້ນ, transcription ແມ່ນຈ່າຍ-ເປັນ-ທ່ານ-ໄປ, ກັບ token top-ups ຈາກ $1.
ບົດບັນທຶກ ເກົາຫລີ ຈະຖືກສົ່ງຄືນເປັນສະກຣິບໂຕ (UTF-8). ຂໍ້ຄວາມ ເກົາຫລີ ບໍ່ມີຊ່ອງຫວ່າງລະຫວ່າງຄໍາໂດຍທໍາມະຊາດ; ເວລາທີ່ລະບຸໄວ້ໃນບັນທຶກເພີ່ມການຢຸດຊົ່ວຄາວທີ່ທໍາມະຊາດເມື່ອຜູ້ເວົ້າປ່ຽນ.
MP3, WAV, M4A, FLAC, OGG, OPUS, ແລະ WEBM ແມ່ນໄດ້ຮັບການຍອມຮັບໂດຍກົງ. ສໍາລັບວິດີໂອ (MP4, MOV, MKV) ພວກເຮົາດຶງດູດສຽງດົນຕີ track ຂ້າງເຊີບເວີກ່ອນທີ່ຈະສົ່ງມັນໄປ Whisper - ທ່ານບໍ່ຈໍາເປັນຕ້ອງປ່ຽນແປງສິ່ງໃດແດ່ເອງ. pipeline ດຽວກັນບໍ່ວ່າຈະເປັນພາສາຕົ້ນຕໍ, ລວມທັງ ເກົາຫລີ.
ບໍ່ມີຊື່ອັບໂຫລດກອບໃນປະມານ 500 MB ຕໍ່ໄຟລ໌. ເຂົ້າສູ່ລະບົບບັນຊີໄປເຖິງ2GB. ໄລຍະເວລາແມ່ນບໍ່ຈໍາກັດຫຍຸ້ງຍາກ - ໄຟລ໌ຍາວແມ່ນ chunked ໂດຍອັດຕະໂນມັດ (30 ວິນາທີກັບ overlap window) ແລະ stitch ຄືນໄປບ່ອນໃນ transcript ດຽວກັບ timestamps ຕໍ່ໄປ. ຫຼາຍຊົ່ວໂມງ ເກົາຫລີ ການບັນທຶກ (podcasts, lectures ເຕັມ, ກອງປະຊຸມ) ເຮັດວຽກດີ.
ຍິນດີຕ້ອນຮັບ - speaker diarization ແມ່ນປິດໂດຍ default ສໍາລັບ transcript ທຸກໆ ເກົາຫລີ. ຜົນໄດ້ຮັບແມ່ນ segmented ເປັນ Speaker 1 / Speaker2/ Speaker3ກັບ timestamps, ດັ່ງນັ້ນການສໍາພາດ, ກອງປະຊຸມປຶກສາຫາລື, ແລະ multi-party ປະຊຸມມາກັບຄືນມາມີស្លាກ. Diarization ແລ່ນໃນແບບທີ່ແຍກຕ່າງຫາກແລະເຮັດວຽກຄືກັນໃນທົ່ວພາສາທັງຫມົດທີ່ພວກເຮົາສະຫນັບສະຫນູນ.
ຍິນດີ - ປ້າຍ URL ເຂົ້າໄປໃນ / transcribe / youtube / ສໍາລັບ YouTube ຫຼື / transcribe / podcast / ສໍາລັບ podcast feeds (Apple, Spotify, RSS). ພວກເຮົາດາວໂຫລດສຽງ, ແລ່ນມັນຜ່ານ Whisper ກັບພາສາ=ko, ແລະກັບຄືນໄປບ່ອນ transcript ກັບ timestamps ແລະເຄື່ອງຫມາຍຜູ້ເວົ້າ. ເນື້ອໃນ ເກົາຫລີ ປົກກະຕິ: podcasts, ການສອນ, ການສໍາພາດ, ແລະເນື້ອໃນ YouTube ແບບຟອມຍາວໃນ ເກົາຫລີ ແມ່ນຄວາມກົດດັນວຽກທົ່ວໄປທີ່ສຸດທີ່ພວກເຮົາເຫັນ.
Whisper ຄ່າໃຊ້ຈ່າຍປະມານ 50 tokens ຕໍ່ນາທີຂອງສຽງ, ດັ່ງນັ້ນການບັນທຶກຫນຶ່ງຊົ່ວໂມງແມ່ນ ~3,000 tokens. ຜູ້ໃຊ້ສ່ວນໃຫຍ່ບໍ່ເຄີຍໃຊ້ຈ່າຍຫຍັງ - ຫ້ອງນ້ໍາຟຣີທຸກໆມື້ຂອງ 30,000 tokens ປົກຄຸມຄລິບສັ້ນ, ຂໍ້ຄວາມສຽງ, ແລະ podcasts ຫນຶ່ງ-off. ນອກເຫນືອໄປຈາກມັນ, ການແປແມ່ນຈ່າຍ-ເປັນ-ທ່ານ-ໄປ, ທີ່ມີ token top-ups ຈາກ $1.
ຍິນດີ - ລະດັບ segment (ທຸກໆ ~ 10-30 ວິນາທີ) ແລະ ລະດັບຄໍາ ເວລາ stamps ແມ່ນມີ. ລະດັບຄໍາ ແມ່ນປັ໊ມເດີມສໍາລັບ VTT / SRT ສົ່ງອອກບົດຂຽນພາຍໃຕ້ດັ່ງນັ້ນບົດຂຽນ sync ເສັ້ນ-by-line. ຢູ່ໃນ API ຕັ້ງ timestamps=" ຄໍາ "ໃນຮ່າງກາຍຄໍາຮ້ອງຂໍ. ບົດບັນທຶກ ເກົາຫລີ ຈະຖືກສົ່ງຄືນເປັນສະກຣິບໂຕ (UTF-8). ຂໍ້ຄວາມ ເກົາຫລີ ບໍ່ມີຊ່ອງຫວ່າງລະຫວ່າງຄໍາໂດຍທໍາມະຊາດ; ເວລາທີ່ລະບຸໄວ້ໃນບັນທຶກເພີ່ມການຢຸດຊົ່ວຄາວທີ່ທໍາມະຊາດເມື່ອຜູ້ເວົ້າປ່ຽນ.
ຍິນດີ. POST ສຽງ (multipart/form-data, ຊື່ພື້ນທີ່ "ໄຟລ໌") ໄປ /v1/transcribe / ກັບພາສາ=ko - ຫຼືລົບພາຣາມິດພາສາເພື່ອໃຫ້ Whisper ກວດພົບອັດຕະໂນມັດ. ສົ່ງຄືນ JSON ກັບ transcript, segments, timestamps, ແລະ ແທັກຜູ້ເວົ້າ. ຄໍາແນະນໍາເຕັມແລະ SDK snippets ທີ່ /api /.
ຍິນດີ - ຫຼັງຈາກການແປພາສາສໍາເລັດ, ກົດແປຫຼືຕິດຂໍ້ຄວາມເຂົ້າໄປໃນ / translate /. ເກົາຫລີ ຄູ່ກັບພາສາອື່ນໆທຸກຢ່າງທີ່ພວກເຮົາສະຫນັບສະຫນູນ (200+). ສໍາລັບກອງປະຊຸມນາທີປັ໊ບການແປຜ່ານ / summarize /; ສໍາລັບ dubbing ສົ່ງມັນໄປ / voice / tts / ເພື່ອສະແດງສຽງໃນພາສາເປົ້າຫມາຍ.
Whisper ແມ່ນໄດ້ຮັບການຝຶກອົບຮົມໃນ 680K ຊົ່ວໂມງຂອງສຽງທີ່ຈິງໃນໂລກທີ່ສຽງ, ດັ່ງນັ້ນການແປ ເກົາຫລີ ແມ່ນແຂງແຮງຕໍ່ສຽງ background, ນອນດົນຕີ, ແລະໂທລະສັບ-ຄຸນນະພາບການບັນທຶກ. ຕັດຮ້າຍແຮງຫຼືຫຼາຍ speakers ປົກຄຸມຈະຍັງເປັນບາດເຈັບຄວາມຖືກຕ້ອງ.ຖ້າວ່າ ບົດບັນທຶກ ບໍ່ສາມາດໃຊ້ໄດ້ ສົ່ງອີເມວ contact@free.ai ໄປພ້ອມກັບ ເອກະສານ - ພວກເຮົາ ຈະ ຈ່າຍຄືນ ຄ່າ ລິ້ງ ແລະ ເບິ່ງວ່າ ເຄື່ອງຈັກ ອື່ນ ໆ ຈະ ຈັດການ ສຽງຂອງທ່ານໄດ້ດີກວ່າ.