Fal Speech-to-Text
Free.ai
·
stt
·
~500 ቶኮን minute
Fal Speech-to-Text a የንግግር-ወደ-ጽሑፍ ሞዴል ነው በውጭ ሞዴሎች ውስጥ መተላለፍ - ~ 500 ቶኮኖች በየቀኑ (50% በታች በታች ዋጋ ላይ ማርክ)
ብዙ ጊዜ የሚጠየቁ ጥያቄዎች
Fal Speech-to-Text የተናገረውን ድምፅ ወደ ጽሑፍ ይለውጣል. MP3, WAV, M4A, ወይም የቪዲዮ ፋይልን ይጫኑ እና Fal Speech-to-Text ሙሉውን ድምፅ ተጨማሪ ምርጫ SRT / VTT ርዕሶች ጋር ጊዜ ምልክቶች ይመለሳል.
Fal Speech-to-Text handles dozens of languages - Whisper-family models cover 90+, others vary. Pick "auto-detect" or specify the language for highest accuracy.
ቃል-ስህተት መጠን 5-10% በነጻ እንግሊዝኛ አዳራሽ ላይ, 10-20% በጩኸት ወይም accented አዳራሽ ላይ ነው. ትልቅ ልዩነቶች የአንድ አዳራሽ ትልቅ ልዩነቶች በከባድ ጉዳዮች ላይ ትርጉም ያለው የበለጠ ያደርጋሉ - አዳራሽ ከባድ ጊዜ ትልቅ ይምረጡ.
አዎ - ክፍል ሁሉ የመጀመርያ/መጨረሻ ጊዜ ምልክቶች አለው. እንደ SRT ወይም VTT ላኩ ጊዜያትም በቀጥታ ወደ ቪዲዮዎ ይለወጣሉ
Fal Speech-to-Text የፕሪሚየም ትርጉም ማሽን ነው. ስለ ~ 500-1,500 ቶኮኖች በአንድ ደቂቃ ውስጥ የድምፅ, በፊትዎ ሊያመጡ በቀጥታ የተገለጸ. ራስ-ተቆጣጠረ ትርጉም በእርስዎ 30,000-ቶኮን ቀን ቧንቧ ነፃ ይሮጣል; ፕሪሚየም ሞዴሎች ናቸው-እንደ-እርስዎ-መሄድ, ከ $1 ጋር top-ups.
MP3, WAV, M4A, FLAC, OGG, plus video (MP4, MOV, WebM) - የድምፅ ፋይሎችን እናወጣለን። በአንድ ጊዜ 500 ሜባ ከፍለን እንጨምራለን። ረጅም ፋይሎችን? /audio/cut/ን በመለየት ወይም /v1/stt/batch/ን በመጠቀም እንለቅቃለን።
የተናጋሪው መዝገብ ቤት የተለየ መውጫ ነው - "diarize" በ / transcribe / ላይ ይጫኑ. Fal Speech-to-Text መዝገብ ቤትን ይይዛል; መዝገብ ቤት ክፍል ሁሉ በተናጋሪ 1 / ተናጋሪ 2 / ወዘተ.
አዎ - /batch/ የድምፅ ፋይሎችን ዶሴ ይቀበላል. እያንዳንዱ መዝገብ ቤት በ /account/?tab=history ውስጥ በመጀመሪያው ፋይል ስም ይቀመጣል. ለፎልደር- ዛፍ ጥበቃ APIን ይጠቀሙ
አዎ - የድምፅ መልዕክትዎን ወደ /v1/stt/transcribe/ በሞዴል "Fal Speech-to-Text" ይላኩ። በጽሑፍ + ክፍሎች + ቃል-ደረጃ timestamps JSON ይመለሳል. /api/ ሙሉውን ማመልከት አለው።
የራሳቸው የሆስቴል ሞዴሎች አዲሱን በGPUዎች ላይ ይይዛሉ፤ ፕሪሚየም በ DPA ውስጥ ይወጣል፤ አዲሱ ከጋራ መስኮት በኋላ (24h anon, 7d sign-in) ይጥፋል፤ በእርስዎ አቅርቦቶች ላይ አናስተምራም
አዎ - Free.ai የጽሑፍ መዝገበ ቃላትን የቢዝነስ ጥቅም ይሰጣል. ለኦዲዮ ፋይል መብቶች ያስፈልጋሉ (የራስዎ ማስመዝገብ፣ የሊስንስ ቁሳቁስ፣ ወይም የፍቃድ ይዘት)
የወቅቱ ሁኔታ 0.05-0.2× ነው - 60 ደቂቃ የፖድካስት 3-12 ደቂቃዎች ውስጥ ይጻፋል. የፕሪሚየም ሞዴሎች ብዙውን ጊዜ በፍጥነት ይጨርሳሉ. መክፈቻውን ለመክፈት የፍለጋውን ቁልፍ ይጠቀሙ.