ElevenLabs STT

Free.ai · stt · ~500 אסימונים ל- minute

זרוק קובץ שמע או וידאו, או הדבק כתובת למטה

~500 אסימונים ל- minute
פועל בחינם על GPUs שלנו. שדרוג עבור ElevenLabs STT →

ElevenLabs STT הוא a דגם דיבור אל טקסט. Routed through external models — ~500 tokens לדקה (50% markup over upstream cost).

השתמש באמצעות API

OpenAI-התאמה מנוחה API. ליצור מפתח ולקרוא מודל זה בשניות.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"premium/elevenlabs/speech-to-text","audio_url":"https://..."}'
תיעוד API קבל מפתח API

שאלות לעתים קרובות

ElevenLabs STT transcribes spoken audio into text. Upload an MP3, WAV, M4A, or video file and ElevenLabs STT returns the full transcript plus optional SRT/VTT subtitles with timestamps.

ElevenLabs STT handles dozens of languages - Whisper-family models cover 90+, Parakeet covers ~25, others vary. Pick "auto-detect" or specify the language for highest accuracy.

שיעור המילים הוא 5°10% על אודיו אנגלי נקי, 10^20% על אודיו רועש או מבטא. גרסאות גדולות של אותה ארכיטקטורה משתפרות באופן משמעותי במקרים קשים □ לבחור גדול יותר כאשר האודיו הוא מחוספס.

כן, כל קטע כולל חותמת זמן התחלה/ סוף. יצוא כ- SRT או VTT ו- Timemap ישירות על גבי הווידאו שלך.

ElevenLabs STT is a premium transcription engine. About ~500-1,500 tokens per minute of audio, shown live before you generate. Self-hosted transcription runs free on your 30,000-token daily pool; premium models are pay-as-you-go, with top-ups from $1.

MP3, WAV, M4A, FLAC, OGG, בתוספת וידאו (MP4, MOV, WebM) □ אנו לחלץ את האודיו. מקס 500 MB לטעינה. קבצים ארוכים יותר? פצל עם / audio/cut / או להשתמש /v1/st/batch/.

Diarization רמקולים (באנגלית: Speaker diarization) הוא מעבר נפרד, המייצג תוויות diarization כל קטע עם דובר 1 / יו"ר 2 / וכו'.

כל תמליל נוחת ב־ eccount/? tab=history with the original name. עבור שימור עץ התיקייה להשתמש ב־ API.

כן □ POST הקול שלך אל / v1/st/tranchive/ with model="ElevenLabs STT." Returns JSON with text + pages + word-late timestamps. / Api / has the full reference.

מודלים מארחים עצמיים שומרים אודיו על GPUs שלנו; פרמיה עוברת עם DPA. שמע נמחק לאחר חלון שיתוף (24h Anon, 7d חתם ב). אנחנו לא מתאמנים על הקלטים שלך.

כן, Free.ai מענקים שימוש מסחרי בתעתיקים. אתה צריך זכויות על השמע שהעלית (הקלטה משלך, חומר מורשה, או תוכן בהסכמה).

גורם בזמן אמת הוא בערך 0.050.2× podcast 60 דקות trancripts in 3×12 minutes. דגמי Premium לעתים קרובות לסיים מהר יותר. השתמש בכפתור התור כדי לסגור את הלשונית.

Love this tool? Share it!

דרג עמוד זה