каталан чөлөөт орчуулга
каталан аудио болон видеог AI-ээр текст болгон хөрвүүл. Хурдан, үнэн зөв, үнэгүй.
Яаж ажилладаг вэ
- Дараагийн хуудас Free.ai Хувилбарлагч
- Таны каталан аудио эсвэл видео файлыг өргөх
- Бидний хиймэл оюун ухаан каталан-ийг автоматаар олж, бичиж өгнө
- Таны бичлэгийг текст эсвэл SRT субтитр болгон татаж авна
каталан-ийн хөрвүүлэлтийн онцлог
- ✓faster-whisper-ээр дэмжигдсэн (MIT лицензтэй)
- ✓Автомат каталан хэлний олж илрүүлэх
- ✓MP3, WAV, MP4, M4A, FLAC, болон бусад форматуудыг дэмждэг
- ✓Үеийн тэмдэглэл ба субтитр экспортлох (SRT)
- ✓Нэмэлт файлын хэмжээ
- ✓Хувийн ба аюулгүй -- файлууд боловсруулсны дараа устгагдана
Тоглоомын мэдээ
| Хэл | каталан |
| ISO код | ca |
| AI загвар | faster-whisper |
| Үнэ | Хязгааргүй |
Өөр хэл
Бүх хэлийг харахТодорхой асуултууд
Whisper large-v3-turbo нь каталан дээр хамгийн өндөр нарийвчлалтай - стандарт үзүүлэлтээр 7% -ийн алдаатай үгтэй байна. Энэ нь практикт цэвэр студи дууны чанар маш сайн, ярианы дууны чанар бага цэвэрлэгээгээр ашиглаж болохыг хэлнэ. (Tier A, under 7% word error rate on benchmark sets - we publish honest WER tiers rather than marketing claims.)
Тийм ээ - каталан-ийн бичлэг нь эхлээд таны өдөр тутмын үнэгүй токенуудын сангаас авдаг. Хөгжим минутанд 50 токен зарцуулдаг тул өдөр тутмын нууцлаг сан нь өдөрт хэдэн цагийн дууг багтаадаг. Нэвтрсэн хэрэглэгчид өдөр бүр 30,000 токенийн сантай. Үүнээс гадна бичлэг нь $1-ээс эхлэн төлбөртэй байдаг.
каталан транскрипц нь стандарт UTF- 8- ээр хэлний хэвийн үсэг бичлэгтэй эргэж ирнэ.
MP3, WAV, M4A, FLAC, OGG, OPUS, WEBM форматууд шууд хүлээн авагдана. Видео (MP4, MOV, MKV)- ийн хувьд серверийн талд дууны бичлэгийг Whisper руу илгээхдээ татаж авдаг - та өөртөө юу ч өөрчлөх шаардлагагүй. Эх үүсвэр хэлнээс үл хамааран, каталан- ийг ч хамруулан, ижил хоолой ашиглана.
Анноним өргөтгөлийн хэмжээ нь файл бүрт 500 MB-аас хэтрэхгүй. Нэвтрсэн хэрэглэгчид 2GB хүртэлх хэмжээтэй өргөтгөлийг өргөж болно. Энэ нь хатуу хязгаарлалт биш - урт файлууд автоматаар хэсэгчлэн хуваагддаг (30 секундын дэлгэц хоорондоо давхцаж) ба үргэлжилсэн цаг хугацааны тэмдэглэлтэй нэг файлд нэгтгэдэг. Олон цагийн каталан бичлэгүүд (подкаст, бүрэн лекц, уулзалт) сайн ажилладаг.
Зүгээр - зкаталан- ийн бүх бичлэгийн хувьд яригчдын диаристикийг урьдчилан тохируулсан. Үр дүн нь яригч 1 / яригч 2/ яригч 3- ийн хооронд хуваагддаг бөгөөд цаг хугацааны тэмдэглэгээтэй байдаг тул ярилцлага, хэлэлцүүлэг, олон талт уулзалтууд тэмдэглэгдсэн байдаг. Диаристик нь өөр загвар дээр ажилладаг бөгөөд бидний дэмждэг бүх хэл дээр адилхан ажилладаг.
Тийм — URL-ийг YouTube-ийн хувьд /transcribe/youtube/, подкастын (Apple, Spotify, RSS) хувьд /transcribe/podcast/ руу оруулах. Аудиог татаж аваад, хэл=ca-тэй Whisper-ээр дамжуулан, цаг хугацааны тэмдэглэгээ болон яригчдын тэмдэглэгээтэй хамт буцаана. каталан-ийн нийтлэг агуулга: лекц, ярилцлага, дууны тэмдэглэл, YouTube-ийн агуулга каталан-д бүгд ажиллана - URL-ийг /transcribe/youtube/ руу оруулах эсвэл шууд файлыг өргөтгөх.
Whisper costs about 50 tokens per minute of audio, so a one-hour recording is ~3,000 tokens. Most users never spend anything - the free daily pool of 30,000 tokens covers short clips, voice notes, and one-off podcasts. Beyond it, transcription is pay-as-you-go, with token top-ups from $1.
Тийм ээ - хэсэг түвшний (~10-30 секунд тутамд) болон үгийн түвшний цаг хугацааны тэмдэглэгээнүүд байдаг. VTT/SRT-ийн субтитр экспортлохдоо үгийн түвшин нь хэвийн бөгөөд ингэснээр мөр бүрийн дор бичлэгийг синхрончлох боломжтой. API дээр хүсэлтийн биед timestamps="word"-ийг тохируулна. каталан транскрипц нь стандарт UTF- 8- ээр хэлний хэвийн үсэг бичлэгтэй эргэж ирнэ.
Тийм. POST аудио (multipart/form-data, field name "file")-г /v1/transcribe/ руу language=ca - эсвэл Whisper-г автоматаар олж авахын тулд хэлний параметрийг хасна. JSON-г бичлэг, хэсгүүд, цаг, дуу хоолойн тэмдэгтүүдтэй нь буцаана. Бүх холбоос болон SDK-ийн хэсгүүд /api/-д байна.
Тийм ээ - бичлэг дууссаны дараа "Түлхүүр" товчийг дарж эсвэл текстийг /translate/ рүү байрлуулна. каталан нь бидний дэмждэг бүх хэл (200+) -тэй хослодог. Хурлын тэмдэглэлүүд нь бичлэгийг /summarize/ -ээр дамжуулдаг; дуу оруулах нь /voice/tts/ -д дууг нь эх хэл дээр нь гаргахад ашигладаг.
Whisper нь 680K цагийн дууны чимээ, каталан транскрипц нь чимээ, дууны өрөө, болон утасны чанартай бичлэгт найдвартай байдаг. Зөвхөн хэрчсэн эсвэл олон дуут чимээ нь үнэн зөв байдалд нөлөөлнө.Хэрэв бичлэг ашиглагдахгүй бол contact@free.ai хаягаар файлыг илгээх - бид таны токеныг буцааж өгөх бөгөөд өөр мотор таны аудиог илүү сайн боловсруулж чадах эсэхийг шалгана.