Fal Speech-to-Text

Free.ai · stt · ~500 ھەر بىرىگە توكى minute

ئاۋاز ياكى سىن ھۆججىتىنى چۈشۈرىدۇ ياكى URL نى تۆۋەنگە چاپلايدۇ

~500 ھەر بىرىگە توكى minute
بىزنىڭ GPU لىرىمىزدا ھەقسىز ئىشلەيدۇ. بۇنىڭ ئۈچۈن يېڭىلاش Fal Speech-to-Text →

Fal Speech-to-Text a سۆزدىن-ماقالىگە مودىل نىڭ بىر قىسمى. 500 توكىلارنى ھەر مىنۇتتا (50% لىق ماركاپنى ئۈستۈنكى قىممەتتىن) ئارقىلىق يوللىنىدۇ.

API ئارقىلىق ئىشلىتىش

OpenAI بىلەن ماس كېلىدىغان REST API. ئاچقۇچنى قۇرۇپ، بۇ مودېلىنى بىر نەچچە سېكۇنت ئىچىدە چاقىرىۋېتىدۇ.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"premium/speech-to-text","audio_url":"https://..."}'
API پۈتۈكلىرى API ئاچقۇچىنى ئېلىش

كۆپ سورالغان سوئاللار

Fal Speech-to-Text سۆزلەنگەن ئاۋازنى تېكىستكە ئايلاندۇرۇپ بېرىدۇ. MP3، WAV، M4A ياكى سىن ھۆججىتىنى يۈكلەپ بېرىڭ، Fal Speech-to-Text تولۇق ئاۋازنى قايتۇرۇپ بېرىدۇ ھەمدە SRT/VTT قىستۇرمىسىنى ۋاقىت بەلگىسى بىلەن قوشۇپ بېرىدۇ.

Fal Speech-to-Text handles dozens of languages - Whisper-family models cover 90+, others vary. Pick "auto-detect" or specify the language for highest accuracy.

سۆز خاتالىق نىسبىتى 5-10% بولغاندا ئىنگىلىزچە ئاۋازلىق كىتابنى ئاڭلايسىز، 10-20% بولغاندا ئاۋازلىق كىتابنى ئاڭلايسىز. ئوخشاش قۇرۇلمادىكى چوڭ نۇسخىلار بەك قىيىن ئەھۋاللاردا ياخشى ئىشلەيدۇ - ئاۋازلىق كىتاب بەك قىيىن بولسا چوڭ نۇسخىنى تاللاڭ.

ئۇنداق، ھەر بىر بۆلەككە باشلىنىش/ئاخىرلىنىش ۋاقىت بەلگىسى كىرگۈزۈلگەن. SRT ياكى VTT شەكلىدە ئېكسپورت قىلىدۇ، ۋاقىت بەلگىسى تىكلەپ سىنغا كىرگۈزۈلىدۇ.

Fal Speech-to-Text يۇقىرى دەرىجىلىك تەرجىمە ماشىنىسى. ھەر مىنۇتتا 500-1500 توكىلارنى ئىشلەتىدۇ، سىز ياساشتىن بۇرۇن سىزنى كۆرۈپ تۇرىدۇ. ئۆزىڭىزنىڭ 30000 توكىلارنى كۈندىلىك توپلاشىڭىزدا ئۆزىڭىزنىڭ ئولتۇرغۇزغان تەرجىمە مەھسۇلاتلىرى ھەقسىز ئىشلەيدۇ؛ يۇقىرى دەرىجىلىك ماشىنىلار 1 دوللاردىن باشلاپ تولۇقلاشقا بولىدۇ.

MP3، WAV، M4A، FLAC، OGG، ھەمدە سىن (MP4، MOV، WebM) - ئاۋازنى چىقىرىۋېتىمىز. ھەر قېتىم ئېلېكتىرونلۇق ھۆججەت يوللاشتا ئەڭ كۆپ بولغاندا 500 مىبىت. ئۇزۇن ھۆججەتلەرنى /audio/cut/ ياكى /v1/stt/batch/ بىلەن ئايرىۋېتىش كېرەكمۇ؟

Fal Speech-to-Text نىڭ قوللىشى بىلەن تەرجىمە قىلىنىدۇ؛ diarization ھەر بىر بۆلەكنى Speaker 1 / Speaker 2 / قاتارلىقلار بىلەن چەكلەيدۇ.

ئۇنداق - /batch/ ئۈن ھۆججەتلىرىنىڭ مۇندەرىجىسىنى قوبۇل قىلىدۇ. ھەر بىر تەرجىمە ھۆججىتى /account/?tab=history دىكى ئەسلى ھۆججەت نامى بىلەن ئاخىرلايدۇ. مۇندەرىجە دەرىخىنى ساقلاش ئۈچۈن API نى ئىشلىتىڭ.

ئۇنداق ئەمەس - ئاۋازنى /v1/stt/transcribe/ غا POST قىلىڭ. model="Fal Speech-to-Text" نى ئىشلىتىڭ. JSON نى تېكىست + سەپلەم + سۆز دەرىجىسىدىكى ۋاقىت بەلگىسى بىلەن قايتۇرىدۇ. /api/ نىڭ تولۇق ئىزاھاتى بار.

ئۆز-ئۆزىگە ئولتۇرىدىغان مودىللار ئاۋازنى GPU دىكى گرافىكىلىق كارتىغا ساقلايدۇ؛ premium DPA ئارقىلىق ئاۋازنى ئۆتكۈزىدۇ. ئاۋاز ھەمبەھىرلەش كۆزنەكتىن كېيىن يوقىتىدۇ (24 سائەت ئانالون، 7 كۈن كىرگەندىن كېيىن). بىز سىزنىڭ كىرگۈزگەن ئۇچۇرلىرىڭىزنى تەربىيەلەمەيمىز.

ئۇنداق ئەمەس - Free.ai نىڭ يازمىلىرىنى تىجارەت قىلىشقا بولىدۇ. ئۈننى كۆچۈرۈش ھوقۇقىڭىز (ئۆزىڭىزنىڭ يازمىلىرىڭىز، رۇخسەتنامە ياكى ئىجازەت بىلەن كىرگۈزۈلگەن مەزمۇنلار) بولۇشى كېرەك.

راستىنلا ۋاقىتلىق فاكتور 0.05-0.2× - 60 مىنۇتلۇق پودكاستى 3-12 مىنۇت ئىچىدە يېزىلغان. Premium تىپىدىكىلەر كۆپىنچە تېزرەك تاماملايدۇ. بەتكۈچنى تاقايدىغان بولساق، ئالدىنقى قاتارغا قويۇش بۇيرۇقىنى ئىشلىتىمىز.

Free.ai نى ياخشى كۆرىسىزمۇ؟ دوستلىرىڭىزغا ئېيتىپ بېرىڭلار!

بۇ بەت ئۈچۈن باھا قويۇش