ElevenLabs STT

Free.ai · stt · ~500 אסימונים ל- minute

זרוק קובץ שמע או וידאו, או הדבק כתובת למטה

~500 אסימונים ל- minute
פועל בחינם על GPUs שלנו. שדרוג עבור ElevenLabs STT →

ElevenLabs STT הוא a דגם דיבור אל טקסט. ניתב באמצעות מודלים חיצוניים - ~500 אסימונים לדקה (50% סימון מעל עלויות הזרם).

השתמש באמצעות API

OpenAI-התאמה מנוחה API. ליצור מפתח ולקרוא מודל זה בשניות.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"premium/elevenlabs/speech-to-text","audio_url":"https://..."}'
תיעוד API קבל מפתח API

שאלות לעתים קרובות

ElevenLabs STT trancribles voided vodication into text. load a MP3, WAV, M4A, or video file and ElevenLabs STT returns the full transcription and opensal SRT/VT wibbles with temetamps.

ElevenLabs STT handles dozens of languages - Whisper-family models cover 90+, others vary. Pick "auto-detect" or specify the language for highest accuracy.

שיעור המילים הוא 5-10% באודיו אנגלי נקי, 10-20% על שמע רועש או מבטא. גרסאות גדולות של אותה ארכיטקטורה משתפרות באופן משמעותי במקרים קשים - בחר גדול יותר כאשר הקול קשה.

כן - כל קטע כולל חותמת זמן התחלה/ סוף. יצוא כ- SRT או VTT וה- Timemap ישירות אל הווידאו שלך.

ElevenLabs STT הוא מנוע תמליל פרמיה. כ-500-1,500 אסימונים לדקה של שמע, מוצגים בשידור חי לפני שאתה מייצר. תמליל עצמי פועל בחינם על הבריכה היומית שלך 30,000-token; מודלים פרמיה הם לשלם-as-y-you-go, עם למעלה מ-1 $.

MP3, WAV, M4A, FLAC, OGG, פלוס וידאו (MP4, MOV, WebM) - אנו מוציאים את השמע. מקס 500MB לטעינה. קבצים ארוכים יותר? פצל עם /audio/cut / או להשתמש /v1/st/batch/.

דיאריזציה של הדובר היא מעבר נפרד - מלגלגלת "דיאריזה" על /trancript /. ElevenLabs STT מטפל בתעתיק; דיאריזציה מתייגת כל קטע עם דובר 1 / דובר 2 / וכו '.

כן -/ Batch/ accepted a file of vodicles. כל תמליל נוחת ב־/account/? tab=history with the original name. for file- tree reservation use the API.

כן - PST - הקול שלך ל /v1/st/tranchimt / with model="ElevenLabs STT". מחזיר את JSON עם טקסט + קטעים + tword- slate timestamps. / Api/ יש התייחסות מלאה.

מודלים מאוכסנים עצמיים שומרים על שמע על GPUs שלנו; פרמיה עוברת עם DPA. שמע נמחק לאחר חלון שיתוף (24h Anon, 7d חתם ב). אנחנו לא מתאמנים על הקלט שלך.

כן - Free.ai מעניק שימוש מסחרי בתעתיקים. אתה צריך זכויות על השמע שהעלית (ההקלטה שלך, החומר המוסמך, או תוכן בהסכמה).

גורם בזמן אמת הוא בערך 0.05-0.2× - פודקאסט בן 60 דקות מתעד ב-3-12 דקות. מודלים פרימיום לעתים קרובות מסיימים מהר יותר. השתמש בכפתור התור כדי לסגור את הכרטיסייה.

Love Free.ai? Tell your friends!

דרג את העמוד הזה