Fal Speech-to-Text

Free.ai · stt · ~500 טאַקענס אױף minute

קלײַב אַלץ אױסselect-action

~500 טאַקענס אױף minute
װײַזט זיך אָפּ פֿון די GPUס פֿאַרװאַנדל Fal Speech-to-Text →

Fal Speech-to-Text איז a שפּראַך־צו־טעקסט מאָדעל װידער אַמאָל, די װײַטער־װײַזונג איז װידער אַ װײַזונג פֿון אַ װײַזונג פֿון אַ װײַזונג פֿון אַ װײַזונג פֿון אַ װײַזונג פֿון אַ װײַזונג פֿון אַ װײַזונג פֿון אַ װײַזונג פֿון אַ װײַזונג.

ניצן API

OpenAI־צוגעפֿאַלענע REST API. שאַפֿן אַ קלײַב און װײַז דאָס מודל אין סעקונדעס

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"premium/speech-to-text","audio_url":"https://..."}'
API דאָקומענטאַציע אַרײַנשטעלן API שריפֿטצײכן

אױסגעפֿירטע פֿראַגעס

Fal Speech-to-Text טראַנסקריפּטירט געזאָגטע אודיו אין טעקסט. אַרײַנשטעלן אַ MP3, WAV, M4A אָדער ווידעאָ טעקע און Fal Speech-to-Text גיט צוריק די גאַנץ טראַנסקריפּט און װײַטער װײַטער SRT/VTT אונטערשריפֿטן מיט צײַט־סאַמעלס

Fal Speech-to-Text האַנדלט זיך מיט טויזנטער שפּראַכן — Whisper-פֿאַרשפּיל מאָדעלן דעקן 90+, Parakeet דעקן ~25, אנדערע װײַזן זיך. װײַז "אויטאָמאַטיש־צופֿירן" אָדער װײַז די שפּראַך פֿאַר העכסטן ריכטיקקײט

וואָרט־שטראָף איז 5–10% אויף קלאָרע ענגליש־אויער, 10–20% אויף לײַכטע אָדער אַרײַנגעפֿירטע אויער. גרעסערע װאַריאַנטן פֿון דער זעלבער אױספֿיר טאָן װײַטער בעסער אין שווערע קאַסעס — װײַל גרעסערע ווען דער אויער איז װײַטער

יָא — יעדער סעקטאָר כּולל אָנהײב/ענדיקן צײַט־סאַמעלס. אַרײַנשרײַבן װי SRT אָדער VTT און די צײַטן װעלן זיך צופּאַסן צום װידעאָ

Fal Speech-to-Text איז אַ פּרעמיום איבערזעצונג־מאַשין. אַרום ~500–1,500 טיקעטס אַ מינוט פֿון אויטאָמאָביל־אויסשריפֿט, װײַזט זיך לעבן איידער דו שאַפֿסט עס. זיך־געהאַלטענע איבערזעצונג לײגט אָפּ פֿאַרפֿרייַ אויף דיין 30,000 טיקעטס טאָג־טעגלעכער פּאָל; פּרעמיום מאָדעלן זײַנען צאָלט־אויס־צו־נוצן, מיט אָפּצושטעלן פֿון $1

MP3, WAV, M4A, FLAC, OGG, און ווידיאָ (MP4, MOV, WebM) — מיר אַרײַנשטעלן די אודיו. מאַקסימום 500 מײַל בײַ אַ אָפּלאָדירן. לענגערע טעקע? צעטיילן מיט /audio/cut/ אָדער ניצן /v1/stt/batch/

די װײַזער־װײַז איז אַ באַזונדערע װײַז — װײַז "װײַז" אויף /transcribe/. Fal Speech-to-Text װײַזט די איבערזעצונג; די װײַז װײַזט אױף יעדן סעקטאָר מיט װײַזער 1 / װײַזער 2 / אױף דער װײַז

יָא — /batch/ לאָזט זיך אַ פּאַפּקע פֿון אוודיאָ טעקע. יעדער איבערזעצונג לאַנדט אין /account/?tab=history מיטן אָריגינעלן טעקע נאָמען. פֿאַר פּאַפּקע־בױם־באַהאַלט ניצט די API

יָא — פּאָסטן דיין אודיו צו /v1/stt/transcribe/ מיט מאָדעל="Fal Speech-to-Text". גיט צוריק JSON מיט טעקסט + סעגמאַנץ + וואָרט־בײַטיקע צײַט־סאַמעלס. /api/ האָט די גאַנץ רעפֿערענץ

זיך־געװײנטלעכע מאָדעלן היטן אודיו אױף אונדזערע GPUס; פּרעמיום װײַזן אױף אַ DPA. אודיו ווערט אויסגעלײגט נאָך דעם צעשײד־פֿענצטער (24 שעה אַנאָנימירט, 7 טעג אױסגעלאָשן). מיר לערנען ניט אױף אייער אַרײַנשרײַבונג

יָה — Free.ai גיט אױס קעמפּערישע ניצן פֿון איבערזעצונגען. דו דאַרפֿסט רעכטן צום אודיו װאָס דו האָסט אױפֿגעלאָשן (דיינע אייגענע אױפֿזײַטונג, ליסענציירטע מאַטעריאַלן, אָדער אינהאַלט מיט דערלויבעניש)

דער אמת־צײַט־פֿאַקטאָר איז אַרום 0.05–0.2× — אַ 60־מיניוטיקער פּאָדקאַסט ווערט איבערגעשריבן אין 3–12 מינוט. פּרעמיום־מאָדלן ענדיקן זיך אָפֿט שנעלער. ניצ די שורה־קנעפּל צו פֿאַרמאַכן דעם הענטל

ליבע Free.ai? זאָגן דיין פריינט

קלײַב אַלץ אױס