ElevenLabs STT

Free.ai · stt · ~500 குறிகள் minute

ஒலி அல்லது வீடியோ கோப்பினை இழுக்கவும் அல்லது URL ஐ கீழே ஒட்டுக

~500 குறிகள் minute
எங்கள் GPUs மீது இலவசமாக இயங்குகிறது. இதற்கு மேம்படுத்து ElevenLabs STT →

ElevenLabs STT a பேச்சு-உரை மாதிரி. வெளிப்புற மாதிரிகள் வழியாக வழிநடத்தப்பட்டது - ~500 டாக்கன்கள் நிமிடங்கள் (50% மார்கப் மேலே செலவு).

API மூலம் பயன்படுத்து

OpenAI-க்கு ஏற்ற REST API. ஒரு விசையை உருவாக்கவும் இந்த மாதிரியை நொடிகளில் அழைக்கவும்.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"premium/elevenlabs/speech-to-text","audio_url":"https://..."}'
API ஆவணமாக்கம் API விசை பெறு

அடிக்கடி கேட்கப்படும் கேள்விகள்

ElevenLabs STT பேசப்பட்ட ஒலியை உரைக்குள் மாற்றுகிறது. MP3, WAV, M4A, அல்லது வீடியோ கோப்பினை ஏற்றவும் ElevenLabs STT முழுமையான மாற்றத்தை தரும் மற்றும் தேர்ந்தெடுக்கக்கூடிய SRT/VTT துணை தலைப்புகளை நேர அச்சிடத்துடன்.

ElevenLabs STT handles dozens of languages - Whisper-family models cover 90+, others vary. Pick "auto-detect" or specify the language for highest accuracy.

வார்த்தை- பிழை விகிதம் 5-10% சுத்தமான ஆங்கில ஒலியில், 10-20% இரைச்சல் அல்லது அழுத்தம் ஒலியில். பெரிய வடிவமைப்புகள் அதே கட்டமைப்பு மிகவும் கடினமான வழக்குகளில் சிறந்தவை - ஒலி மெலிந்தால் பெரியதை தேர்ந்தெடு.

ஆம் - ஒவ்வொரு பகுதியும் தொடங்கல்/முடிவு நேரத்தை உள்ளடக்கியது. SRT அல்லது VTT ஆக ஏற்றுமதி செய்யவும் மற்றும் நேர வரைபடம் உங்கள் வீடியோவில் நேரடியாக இருக்கும்.

ElevenLabs STT ஒரு பிரீமியம் மொழிபெயர்ப்பு இயந்திரம். ஒலிக்கு ஒரு நிமிடத்திற்கு ~500-1,500 டாக்கன்கள், நீங்கள் உருவாக்குவதற்கு முன்பு நேரடியாக காட்டப்படுகிறது. தனியாக-அமைக்கப்பட்ட மொழிபெயர்ப்பு உங்கள் 30,000-டாக்கன்கள் தினசரி பந்தலில் இலவசமாக இயங்குகிறது; பிரீமியம் மாதிரிகள் $1 முதல் அதிகப்படுத்தப்பட்டவையாக உள்ளன.

MP3, WAV, M4A, FLAC, OGG, plus video (MP4, MOV, WebM) - ஒலியை பிரித்தெடுக்கிறோம். ஒரு பதிவேற்றத்திற்கு அதிகபட்சம் 500 MB. நீண்ட கோப்புகள்? /audio/cut/ அல்லது /v1/stt/batch/ பயன்படுத்தி பிரிக்கவும்.

பேசுபவர் தினசரி என்பது தனியான ஒரு பாதையாகும் - "diarize" /transcribe/ ல் மாற்றவும். ElevenLabs STT தினசரியை கையாளும்; தினசரி ஒவ்வொரு பகுதியையும் பேசுபவர் 1 / பேசுபவர்2/ etc. ஐக் கொண்டுள்ளது

ஆம் - / batch / ஒலி கோப்புகளின் அடைவை ஏற்றுக் கொள்கிறது. ஒவ்வொரு ஒலித்தொகுப்பும் / account /? tab=history ல் துவக்க கோப்பு பெயருடன் உள்ளது. அடைவு- மரத்தை பாதுகாக்க API ஐ பயன்படுத்தவும்.

ஆம் - உங்கள் ஒலியை /v1/stt/transcribe/ model="ElevenLabs STT" உடன் POST செய்யவும். JSON உரை + பகுதிகள் + வார்த்தை-மட்ட நேர அட்டவணைகளுடன் திரும்பும். /api/ முழு குறிப்பு உள்ளது.

தனியாக நிறுவப்பட்ட மாதிரிகள் ஒலியை எங்கள் GPU களில் வைத்திருக்கின்றன; பிரீமியம் DPA மூலம் செல்கிறது. ஒலி பகிர்வு சாளரத்திற்குப் பிறகு நீக்கப்படுகிறது (24 மணி நேரம், 7d நுழைவு). உங்கள் உள்ளீடுகளை நாங்கள் பயிற்சி செய்யவில்லை.

ஆம் - Free.ai வரிவடிவங்களை வர்த்தக ரீதியாக பயன்படுத்த அனுமதிக்கிறது. நீங்கள் பதிவேற்றிய ஒலிக்கு உரிமை தேவை (உங்கள் சொந்த பதிவு, அனுமதி பெற்ற பொருள் அல்லது அனுமதியுடன் உள்ளடக்கம்).

உண்மையான நேர காரணி சுமார் 0.05-0.2× - 60 நிமிடப் போட்காஸ்ட்3- 12 நிமிடங்களில் பதிவு செய்யப்படுகிறது. பிரீமியம் மாதிரிகள் எப்போதும் விரைவாக முடிகிறது. தத்தலை மூட வரிசை பொத்தானை பயன்படுத்தவும்.

காதல் Free.ai? உங்கள் நண்பர்களுக்கு கூறுங்கள்!

இந்த பக்கத்தை மதிப்பீடு செய்