Fal Speech-to-Text

Free.ai · stt · ~500 ટોકન પ્રતિ minute

ઓડિયો અથવા વિડીયો ફાઇલ મૂકો, અથવા URL નીચે ચોંટાડો

~500 ટોકન પ્રતિ minute
અમારા GPUs પર મુક્ત રીતે ચાલે છે. માટે સુધારો Fal Speech-to-Text →

Fal Speech-to-Text એ a ભાષણ-થી-લખાણ મોડેલ છે. બાહ્ય મોડેલો મારફતે માર્ગદર્શિત - ~500 ટોકન મિનિટ (50% માર્કઅપ ઉપર અપસ્ટ્રીમ ખર્ચ).

API વડે વાપરો

OpenAI-સુસંગત REST API. કી બનાવો અને સેકન્ડોમાં આ મોડેલને બોલાવો.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"premium/speech-to-text","audio_url":"https://..."}'
API દસ્તાવેજ API કી મેળવો

વારંવાર પૂછાતા પ્રશ્નો

Fal Speech-to-Text લખાણમાં બોલાયેલ ઓડિયોનું અનુવાદ કરે છે. MP3, WAV, M4A, અથવા વિડીયો ફાઈલ અપલોડ કરો અને Fal Speech-to-Text સમયસમાપ્તિ સાથે વૈકલ્પિક SRT/VTT ઉપશીર્ષકો સાથે સંપૂર્ણ અનુવાદ પાછો આપે છે.

Fal Speech-to-Text handles dozens of languages - Whisper-family models cover 90+, others vary. Pick "auto-detect" or specify the language for highest accuracy.

શબ્દ-ક્ષતિ દર સાફ અંગ્રેજી ઓડિયો પર ૫-૧૦% છે, ઊંઘતા અથવા અવાજો સાથેના ઓડિયો પર ૧૦-૨૦% છે. એ જ આર્કિટેક્ચરની મોટી આવૃત્તિઓ હરકતના કિસ્સામાં અર્થપૂર્ણ રીતે સારી રીતે કરે છે - જ્યારે ઓડિયો કઠિન હોય ત્યારે મોટું પસંદ કરો.

હા - દરેક સેગમેન્ટ શરૂઆત/અંત સમયસમાપ્તિઓ સમાવે છે. SRT અથવા VTT તરીકે નિકાસ કરો અને સમય મેપ તમારા વિડિયો પર સીધો જાઓ.

Fal Speech-to-Text એ પ્રીમિયમ ટ્રાન્સક્રિપ્શન એન્જિન છે. ઓડિયોનાં મિનિટ દીઠ ~500-1,500 ટોકન વિશે, તમે ઉત્પન્ન કરતા પહેલા જીવંત બતાવે છે. સ્વયં-હોસ્ટ થયેલ ટ્રાન્સક્રિપ્શન તમારા 30,000-ટોકન રોજિંદા પુલ પર મુક્ત રીતે ચાલે છે; પ્રીમિયમ મોડેલો $1 થી ટોપ-અપ સાથે તમે-જાઓ-તેમ-પૈસા-આપવા-છે.

MP3, WAV, M4A, FLAC, OGG, વીડિયો (MP4, MOV, WebM) - અમે ઓડિયો કાઢી નાંખીએ છીએ. અપલોડ પર મહત્તમ ૫૦૦ MB. લાંબી ફાઈલો? /audio/cut/ સાથે વિભાજીત કરો અથવા /v1/stt/batch/ વાપરો.

સ્પીકર ડાયરીકરણ અલગ પાસવર્ડ છે - /transcribe/ પર "diarize" બદલો. Fal Speech-to-Text લખાણને સંભાળે છે; ડાયરીકરણ સ્પીકર ૧ / સ્પીકર ૨ / વગેરે સાથે દરેક સેગમેન્ટને લેબલ કરે છે

હા - /batch/ ઓડિયો ફાઇલોના ફોલ્ડરને સ્વીકારે છે. દરેક ટ્રાન્સક્રિપ્ટ મૂળભૂત ફાઇલનામ સાથે /account/?tab=history માં સ્થિત થાય છે. ફોલ્ડર-ટ્રી સંગ્રહ માટે API વાપરો.

હા - મોડેલ="Fal Speech-to-Text" સાથે /v1/stt/transcribe/ માં તમારો ઓડિયો POST કરો. લખાણ + સેગમેન્ટ્સ + શબ્દ-સ્તર સમયસૂચકો સાથે JSON પાછું આપે છે. /api/ એ સંપૂર્ણ સંદર્ભ છે.

સ્વયં-હોસ્ટ કરેલ મોડેલો અમારા GPUs પર ઓડિયો રાખે છે; પ્રીમિયમ DPA સાથે પસાર થાય છે. ઓડિયો વહેંચણી-વિન્ડો પછી કાઢી નાંખવામાં આવે છે (24h anoin, 7d sign-in). અમે તમારા ઇનપુટ પર તાલીમ આપતા નથી.

હા - Free.ai ટ્રાન્સક્રિપ્ટનો વાણિજ્યિક ઉપયોગ પ્રદાન કરે છે. તમારે ઓડિયો માટે અધિકારો જરૂરી છે કે જે તમે અપલોડ કર્યા છે (તમારી પોતાની રેકોર્ડિંગ, લાઇસન્સ થયેલ સામગ્રી, અથવા સંમતિ સાથે સમાવિષ્ટો).

વાસ્તવિક સમય ઘટક લગભગ 0.05-0.2× છે - 60-મિનિટ પોડકાસ્ટ 3-12 મિનિટમાં ટ્રાન્સક્રિપ્ટ કરે છે. પ્રીમિયમ મોડેલો ઘણીવાર ઝડપથી સમાપ્ત થાય છે. ટેબ બંધ કરવા માટે કતાર બટનનો ઉપયોગ કરો.

Free.ai પ્રેમ કરો? તમારા મિત્રોને કહો!

આ પાનાંને દર આપો