ElevenLabs STT

Free.ai · stt · ~500 टोकन प्रति minute

ऑडिओ किंवा व्हिडीओ फाइल टाकून द्या, किंवा URL खाली चिकटवा

~500 टोकन प्रति minute
याचे मूळ नाव फ्रान्सिस दिब्रिटो होते. साठी अद्ययावत करा ElevenLabs STT →

ElevenLabs STT हे a आहे भाषण- ते- पाठ्य मॉडेल. Routed through external models — ~500 tokens प्रति मिनिट (50% markup over upstream cost).

API द्वारे वापरा

OpenAI-सुसंगत REST API. किल्ली निर्माण करा व सेकंदांमध्ये हे मॉडेल कॉल करा.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"premium/elevenlabs/speech-to-text","audio_url":"https://..."}'
API दस्तऐवजीकरण API कि प्राप्त करा

वारंवार विचारले जाणारे प्रश्न

ElevenLabs STT बोलल्या गेलेल्या ऑडिओला पाठ्य मध्ये रूपांतरित करते. MP3, WAV, M4A, किंवा व्हिडीओ फाइल अपलोड करा आणि ElevenLabs STT पूर्ण रूपांतरित परत करते आणि पर्यायी SRT/VTT उपशीर्षक वेळ स्टॅम्पसह.

ElevenLabs STT handles dozens of languages - Whisper-family models cover 90+, others vary. Pick "auto-detect" or specify the language for highest accuracy.

5-10% शब्द-त्रुटी दर स्वच्छ इंग्रजी ऑडिओवर आहे, 10-20% शोर किंवा उच्चार ऑडिओवर आहे. मोठ्या प्रमाणे तेच आर्किटेक्चरचे मोठे प्रकार कठीण प्रकरणांवर अधिक चांगले कार्य करतात - ऑडिओ कठीण असल्यास मोठे निवडा.

होय - प्रत्येक खंडात प्रारंभ/अंत वेळ स्टॅम्प समाविष्टीत आहे. SRT किंवा VTT प्रमाणे एक्सपोर्ट करा व वेळ मापा तुमच्या व्हिडीओवर थेट.

ElevenLabs STT हे प्रीमियम ट्रान्सक्रिप्शन इंजिन आहे. तुम्ही निर्माण करण्यापूर्वी प्रत्यक्ष दाखविण्यापूर्वी ~500-1,500 टन प्रति मिनिट ऑडिओ टन. स्वतः-होस्ट केलेले ट्रान्सक्रिप्शन तुमच्या 30,000-टन दैनंदिन पूलवर मोफत चालते; प्रीमियम मॉडेल वापराप्रमाणे शुल्क आकारतात, $1 पासून टॉप-अपसह.

MP3, WAV, M4A, FLAC, OGG, प्लस व्हिडीओ (MP4, MOV, WebM) - आम्ही ऑडिओ एक्सट्रॅक्ट करतो. प्रति अपलोड किमान 500 MB. मोठे फाइल? /audio/cut/ सह विभाजित करा किंवा /v1/stt/batch/ वापरा.

Speaker diarization is a separate pass - toggle "diarize" on /transcribe/. ElevenLabs STT handles the transcription; diarization labels each segment with Speaker 1 / Speaker 2 / etc.

होय - /batch/ ऑडिओ फाइलचे संचयीका स्वीकारते. प्रत्येक ट्रान्सक्रिप्ट /account/?tab=history मध्ये मूळ फाइलनाव सह उतरते. संचयीका-वृक्ष संवर्धन करीता API चा वापर करा.

Yes - POST your audio to /v1/stt/transcribe/ with model="ElevenLabs STT". Returns JSON with text + segments + word-level timestamps. /api/ has the full reference.

स्वतः-होस्ट केलेले मॉडेल ऑडिओ आपल्या GPU वर ठेवतात; प्रीमियम DPA द्वारे पार पडते. ऑडिओ शेअर-विंडो नंतर काढून टाकले जाते (24h अनॉन, 7d दाखलन-इन). आम्ही तुमच्या इनपुटवर प्रशिक्षण देत नाही.

होय - Free.ai मुद्रणाच्या व्यावसायिक वापरास परवानगी देते. तुम्ही अपलोड केलेल्या ऑडिओसाठी तुम्हाला अधिकार हवे आहेत (तुमचे स्वतःचे रेकॉर्डिंग, परवानाकृत सामग्री, किंवा परवानगीसह अनुक्रम).

वास्तविक वेळ घटक सुमारे 0.05–0.2× आहे — 60 मिनिटांचे पॉडकास्ट3– 12 मिनिटांमध्ये transcribes. प्रीमियम मॉडेल बहुधा लवकर पूर्ण होते. टॅब बंद करण्यासाठी क्यु बटण वापरा.

Free.ai ला आवडते? आपल्या मित्रांना सांगा!

या पानाचे गुणांकन करा