ElevenLabs STT

Free.ai · stt · ~500 ਟੋਕਨ ਪ੍ਰਤੀ minute

ਆਡੀਓ ਜਾਂ ਵੀਡਿਓ ਫਾਇਲ ਸੁੱਟੋ ਜਾਂ URL ਹੇਠਾਂ ਚਿਪਕਾਓ

~500 ਟੋਕਨ ਪ੍ਰਤੀ minute
ਸਾਡੇ GPUs ਉੱਤੇ ਮੁਫਤ ਚੱਲਦਾ ਹੈ। ਇਸ ਲਈ ਅੱਪਗਰੇਡ ElevenLabs STT →

ElevenLabs STT ਅਤੇ a ਬੋਲੀ- ਤੋਂ- ਪਾਠ ਮਾਡਲ. ਬਾਹਰੀ ਮਾਡਲਾਂ ਰਾਹੀਂ ਰੂਟ ਕੀਤਾ - ~500 ਟੋਕਨ ਪ੍ਰਤੀ ਮਿੰਟ (ਅੱਪਸਟਰੀਮ ਲਾਗਤ ਤੋਂ 50% ਮਾਰਕਅਪ)

API ਰਾਹੀਂ ਵਰਤੋਂ

OpenAI- ਅਨੁਕੂਲ REST API ਹੈ। ਇੱਕ ਕੁੰਜੀ ਬਣਾਓ ਅਤੇ ਇਸ ਮਾਡਲ ਨੂੰ ਸਕਿੰਟ ਵਿੱਚ ਕਾਲ ਕਰੋ।

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"premium/elevenlabs/speech-to-text","audio_url":"https://..."}'
API ਡੌਕੂਮੈਂਟੇਸ਼ਨ API ਕੁੰਜੀ ਲਵੋ

ਅਕਸਰ ਪੁੱਛੇ ਜਾਂਦੇ ਸਵਾਲ

ElevenLabs STT ਬੋਲੀ ਆਡੀਓ ਨੂੰ ਪਾਠ ਵਿੱਚ ਤਬਦੀਲ ਕਰਦਾ ਹੈ। MP3, WAV, M4A, ਜਾਂ ਵੀਡਿਓ ਫਾਇਲ ਅੱਪਲੋਡ ਕਰੋ ਅਤੇ ElevenLabs STT ਪੂਰੀ ਤਬਦੀਲ ਅਤੇ ਚੋਣਵੀਂ SRT/VTT ਸਬਟਾਈਟਲ ਨੂੰ ਟਾਈਮ-ਸਟੈਂਪ ਨਾਲ ਵਾਪਸ ਕਰ ਦੇਵੇਗਾ।

ElevenLabs STT handles dozens of languages - Whisper-family models cover 90+, others vary. Pick "auto-detect" or specify the language for highest accuracy.

ਸ਼ਬਦ- ਗਲਤੀ ਦਰ ਸਾਫ਼ ਅੰਗਰੇਜ਼ੀ ਆਡੀਓ ਉੱਤੇ 5- 10% ਹੈ, ਨੋਇਸੀ ਜਾਂ ਐਕਸੈਂਟਡ ਆਡੀਓ ਉੱਤੇ 10- 20% ਹੈ । ਇੱਕੋ ਢਾਂਚੇ ਦੇ ਵੱਡੇ ਵੇਰੀਐਂਟ ਸਖਤ ਕੇਸਾਂ ਉੱਤੇ ਚੰਗੇ ਕੰਮ ਕਰਦੇ ਹਨ - ਜਦੋਂ ਆਡੀਓ ਗਿੱਲਾ ਹੋਵੇ ਤਾਂ ਵੱਡਾ ਚੁਣੋ ।

ਹਾਂ - ਹਰੇਕ ਸੈਗਮੈਂਟ ਵਿੱਚ ਸ਼ੁਰੂ/ਅਧਿਆਨ ਟਾਈਮ-ਸਟੈਂਪ ਸ਼ਾਮਲ ਹਨ। SRT ਜਾਂ VTT ਵਾਂਗ ਐਕਸਪੋਰਟ ਕਰੋ ਅਤੇ ਟਾਈਮ ਮੈਪ ਸਿੱਧਾ ਆਪਣੇ ਵਿਡੀਓ ਉੱਤੇ ਕਰੋ।

ElevenLabs STT ਇੱਕ ਪ੍ਰੀਮੀਅਮ ਟਰਾਂਸਕਰੀਪਸ਼ਨ ਇੰਜਣ ਹੈ। ਆਡੀਓ ਦੇ ਪ੍ਰਤੀ ਮਿੰਟ ~500-1,500 ਟੋਕਨ, ਜੋ ਕਿ ਤੁਸੀਂ ਬਣਾਉਣ ਤੋਂ ਪਹਿਲਾਂ ਲਾਈਵ ਵੇਖੋਗੇ। ਸਵੈ-ਹੋਸਟ ਟਰਾਂਸਕਰੀਪਸ਼ਨ ਤੁਹਾਡੇ 30,000-ਟੋਕਨ ਰੋਜ਼ਾਨਾ ਪੁਲ ਉੱਤੇ ਮੁਫ਼ਤ ਚੱਲਦਾ ਹੈ; ਪ੍ਰੀਮੀਅਮ ਮਾਡਲ $1 ਤੋਂ ਵੱਧ ਦੇ ਟਾਪ-ਅੱਪ ਨਾਲ ਭੁਗਤਾਨ-ਜੋ-ਤੁਹਾਨੂੰ-ਜਾਓ ਹਨ।

MP3, WAV, M4A, FLAC, OGG, ਅਤੇ ਵੀਡਿਓ (MP4, MOV, WebM) - ਅਸੀਂ ਆਡੀਓ ਐਕਸਟਰੈਕਟ ਕਰਦੇ ਹਾਂ। ਵੱਧ ਤੋਂ ਵੱਧ 500 MB ਪ੍ਰਤੀ ਅੱਪਲੋਡ। ਲੰਬੀਆਂ ਫਾਇਲਾਂ? /audio/cut/ ਨਾਲ ਵੰਡੋ ਜਾਂ /v1/stt/batch/ ਵਰਤੋਂ।

ਸਪੀਕਰ ਡਾਇਰੀਜ਼ੇਸ਼ਨ ਵੱਖਰਾ ਪਾਸ ਹੈ - /transcribe/ ਉੱਤੇ "diarize" ਬਦਲੋ । ElevenLabs STT ਟਰਾਂਸਕਰੀਪਸ਼ਨ ਹੈਂਡਲ ਕਰਦਾ ਹੈ; ਡਾਇਰੀਜ਼ੇਸ਼ਨ ਹਰੇਕ ਸੈਗਮੈਂਟ ਨੂੰ ਸਪੀਕਰ 1 / ਸਪੀਕਰ2/ ਆਦਿ ਨਾਲ ਲੇਬਲ ਕਰਦਾ ਹੈ ।

ਹਾਂ - /batch/ ਆਡੀਓ ਫਾਇਲਾਂ ਦਾ ਫੋਲਡਰ ਸਵੀਕਾਰ ਕਰਦਾ ਹੈ । ਹਰੇਕ ਟਰਾਂਸਕਰੀਪਟ ਅਸਲੀ ਫਾਇਲ ਨਾਂ ਨਾਲ /account/?tab=history ਵਿੱਚ ਪਹੁੰਚਦੀ ਹੈ । ਫੋਲਡਰ- ਟਰੀ ਸੰਭਾਲਣ ਲਈ API ਵਰਤੋਂ ।

ਹਾਂ - ਆਪਣੇ ਆਡੀਓ ਨੂੰ /v1/stt/transcribe/ ਨਾਲ POST ਕਰੋ, ਜਿਸ ਦਾ ਮਾਡਲ "ElevenLabs STT" ਹੈ । ਪਾਠ + ਸੈਗਮੈਂਟ + ਸ਼ਬਦ- ਪੱਧਰ ਟਾਈਮ- ਸਟੈਂਪ ਨਾਲ JSON ਵਾਪਸ ਕਰੋ । /api/ ਵਿੱਚ ਪੂਰਾ ਹਵਾਲਾ ਹੈ ।

ਆਪਣਾ-ਆਪ ਹੋਸਟ ਮਾਡਲ ਸਾਡੇ GPU ਉੱਤੇ ਆਡੀਓ ਰੱਖਦਾ ਹੈ; ਪ੍ਰੀਮੀਅਮ DPA ਨਾਲ ਪਾਸ ਹੁੰਦਾ ਹੈ। ਸਾਂਝ-ਵਿੰਡੋ ਤੋਂ ਬਾਅਦ ਆਡੀਓ ਹਟਾ ਦਿੱਤਾ ਜਾਂਦਾ ਹੈ (24 ਘੰਟੇ ਬਾਅਦ,7ਦਿਨ ਲਾਗਇਨ ਹੋਣ ਤੋਂ ਬਾਅਦ)। ਅਸੀਂ ਤੁਹਾਡੇ ਇੰਪੁੱਟ ਉੱਤੇ ਟਰੇਨਿੰਗ ਨਹੀਂ ਕਰਦੇ।

ਹਾਂ - Free.ai ਟਰਾਂਸਕਰੀਪਟ ਦਾ ਵਪਾਰਕ ਵਰਤੋਂ ਦਿੰਦਾ ਹੈ । ਤੁਹਾਨੂੰ ਆਡੀਓ ਲਈ ਅਧਿਕਾਰ ਲੋੜੀਦੇ ਹਨ, ਜੋ ਤੁਸੀਂ ਅੱਪਲੋਡ ਕੀਤਾ ਹੈ (ਆਪਣੇ ਰਿਕਾਰਡ, ਲਾਈਸੈਂਸਡ ਮਾਮਲਿਆਂ, ਜਾਂ ਮਨਜ਼ੂਰ ਸਮੱਗਰੀ) ।

ਰੀਅਲ-ਟਾਈਮ ਫੈਕਟਰ ਲਗਭਗ 0.05-0.2× ਹੈ - 60 ਮਿੰਟ ਦਾ ਪੋਡਕਾਸਟ3- 12 ਮਿੰਟ ਵਿੱਚ ਟਰਾਂਸਕਰੀਪਟ ਹੁੰਦਾ ਹੈ । ਪ੍ਰੀਮੀਅਮ ਮਾਡਲ ਅਕਸਰ ਤੇਜ਼ ਹੁੰਦੇ ਹਨ । ਟੈਬ ਬੰਦ ਕਰਨ ਲਈ ਕਤਾਰ ਬਟਨ ਵਰਤੋਂ ।

Free.ai ਨੂੰ ਪਿਆਰ ਕਰੋ? ਆਪਣੇ ਦੋਸਤਾਂ ਨੂੰ ਦੱਸੋ!

ਇਹ ਪੇਜ਼ ਰੇਟਿੰਗ