Wizper (Whisper v3)

Free.ai · stt · ~500 குறிகள் minute

ஒலி அல்லது வீடியோ கோப்பினை இழுக்கவும் அல்லது URL ஐ கீழே ஒட்டுக

~500 குறிகள் minute
எங்கள் GPUs மீது இலவசமாக இயங்குகிறது. இதற்கு மேம்படுத்து Wizper (Whisper v3) →

Wizper (Whisper v3) a பேச்சு-உரை மாதிரி. வெளிப்புற மாதிரிகள் வழியாக வழிநடத்தப்பட்டது - ~500 டாக்கன்கள் நிமிடங்கள் (50% மார்கப் மேலே செலவு).

API மூலம் பயன்படுத்து

OpenAI-க்கு ஏற்ற REST API. ஒரு விசையை உருவாக்கவும் இந்த மாதிரியை நொடிகளில் அழைக்கவும்.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"premium/wizper","audio_url":"https://..."}'
API ஆவணமாக்கம் API விசை பெறு

அடிக்கடி கேட்கப்படும் கேள்விகள்

Wizper (Whisper v3) பேசப்பட்ட ஒலியை உரைக்குள் மாற்றுகிறது. MP3, WAV, M4A, அல்லது வீடியோ கோப்பினை ஏற்றவும் Wizper (Whisper v3) முழுமையான மாற்றத்தை தரும் மற்றும் தேர்ந்தெடுக்கக்கூடிய SRT/VTT துணை தலைப்புகளை நேர அச்சிடத்துடன்.

Wizper (Whisper v3) handles dozens of languages - Whisper-family models cover 90+, others vary. Pick "auto-detect" or specify the language for highest accuracy.

வார்த்தை- பிழை விகிதம் 5-10% சுத்தமான ஆங்கில ஒலியில், 10-20% இரைச்சல் அல்லது அழுத்தம் ஒலியில். பெரிய வடிவமைப்புகள் அதே கட்டமைப்பு மிகவும் கடினமான வழக்குகளில் சிறந்தவை - ஒலி மெலிந்தால் பெரியதை தேர்ந்தெடு.

ஆம் - ஒவ்வொரு பகுதியும் தொடங்கல்/முடிவு நேரத்தை உள்ளடக்கியது. SRT அல்லது VTT ஆக ஏற்றுமதி செய்யவும் மற்றும் நேர வரைபடம் உங்கள் வீடியோவில் நேரடியாக இருக்கும்.

Wizper (Whisper v3) ஒரு பிரீமியம் மொழிபெயர்ப்பு இயந்திரம். ஒலிக்கு ஒரு நிமிடத்திற்கு ~500-1,500 டாக்கன்கள், நீங்கள் உருவாக்குவதற்கு முன்பு நேரடியாக காட்டப்படுகிறது. தனியாக-அமைக்கப்பட்ட மொழிபெயர்ப்பு உங்கள் 30,000-டாக்கன்கள் தினசரி பந்தலில் இலவசமாக இயங்குகிறது; பிரீமியம் மாதிரிகள் $1 முதல் அதிகப்படுத்தப்பட்டவையாக உள்ளன.

MP3, WAV, M4A, FLAC, OGG, plus video (MP4, MOV, WebM) - ஒலியை பிரித்தெடுக்கிறோம். ஒரு பதிவேற்றத்திற்கு அதிகபட்சம் 500 MB. நீண்ட கோப்புகள்? /audio/cut/ அல்லது /v1/stt/batch/ பயன்படுத்தி பிரிக்கவும்.

பேசுபவர் தினசரி என்பது தனியான ஒரு பாதையாகும் - "diarize" /transcribe/ ல் மாற்றவும். Wizper (Whisper v3) தினசரியை கையாளும்; தினசரி ஒவ்வொரு பகுதியையும் பேசுபவர் 1 / பேசுபவர்2/ etc. ஐக் கொண்டுள்ளது

ஆம் - / batch / ஒலி கோப்புகளின் அடைவை ஏற்றுக் கொள்கிறது. ஒவ்வொரு ஒலித்தொகுப்பும் / account /? tab=history ல் துவக்க கோப்பு பெயருடன் உள்ளது. அடைவு- மரத்தை பாதுகாக்க API ஐ பயன்படுத்தவும்.

ஆம் - உங்கள் ஒலியை /v1/stt/transcribe/ model="Wizper (Whisper v3)" உடன் POST செய்யவும். JSON உரை + பகுதிகள் + வார்த்தை-மட்ட நேர அட்டவணைகளுடன் திரும்பும். /api/ முழு குறிப்பு உள்ளது.

தனியாக நிறுவப்பட்ட மாதிரிகள் ஒலியை எங்கள் GPU களில் வைத்திருக்கின்றன; பிரீமியம் DPA மூலம் செல்கிறது. ஒலி பகிர்வு சாளரத்திற்குப் பிறகு நீக்கப்படுகிறது (24 மணி நேரம், 7d நுழைவு). உங்கள் உள்ளீடுகளை நாங்கள் பயிற்சி செய்யவில்லை.

ஆம் - Free.ai வரிவடிவங்களை வர்த்தக ரீதியாக பயன்படுத்த அனுமதிக்கிறது. நீங்கள் பதிவேற்றிய ஒலிக்கு உரிமை தேவை (உங்கள் சொந்த பதிவு, அனுமதி பெற்ற பொருள் அல்லது அனுமதியுடன் உள்ளடக்கம்).

உண்மையான நேர காரணி சுமார் 0.05-0.2× - 60 நிமிடப் போட்காஸ்ட்3- 12 நிமிடங்களில் பதிவு செய்யப்படுகிறது. பிரீமியம் மாதிரிகள் எப்போதும் விரைவாக முடிகிறது. தத்தலை மூட வரிசை பொத்தானை பயன்படுத்தவும்.

காதல் Free.ai? உங்கள் நண்பர்களுக்கு கூறுங்கள்!

இந்த பக்கத்தை மதிப்பீடு செய்