Fal Speech-to-Text

Free.ai · stt · ~500 Тоглоомын тэмдэгт minute

Аудио эсвэл видео файлыг буцаан байршуулах эсвэл URL-ийг доошоо байршуулах

~500 Тоглоомын тэмдэгт minute
График процессор дээр чөлөөтэй ажиллана. Шинэчлэх Fal Speech-to-Text →

Fal Speech-to-Text нь a ярианаас текст рүү загвар. Гадна загваруудаар дамжуулан залгасан - ~500 tokens минут (50% upstream cost-аас илүү).

API- ээр ашиглах

OpenAI-тай нийцсэн REST API. түлхүүр үүсгэж, энэ загварыг секундэд дуудна.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"premium/speech-to-text","audio_url":"https://..."}'
Тохиргооны баримт бичиг API түлхүүрийг авах

Заримдаа асуудаг асуултууд

Fal Speech-to-Text нь ярианы дууг текст болгон хөрвүүлдэг. MP3, WAV, M4A, эсвэл видео файлыг татаж аваад Fal Speech-to-Text нь бүрэн хөрвүүлэлтийг, мөн сонголттой SRT/VTT субтитрийг цаг хугацааны тэмдэглэгээтэй нь буцаана.

Fal Speech-to-Text handles dozens of languages - Whisper-family models cover 90+, others vary. Pick "auto-detect" or specify the language for highest accuracy.

Англи хэлний үгийн алдааны хувь нь цэвэр Англи хэлний аудиод 5- 10%, дуу чимээ ихтэй эсвэл өнгөлөг аудиод 10- 20% байдаг. Ижил бүтэцтэй том хувилбарууд хатуу үсэгний хувьд илүү сайн ажилладаг - дуу чимээ нь хатуу бол том хувилбарыг сонгоно.

Тийм ээ - бүх хэсгүүд эхлэх/ дуусах цагийг агуулдаг. SRT эсвэл VTT хэлбэрээр экспортлох ба цагийг шууд видеонд харуулна.

Fal Speech-to-Text нь үнэтэй орчуулгын машин юм. Та үүсгэхээсээ өмнө минут тутамд ~500-1500 токен аудиог шууд харуулна. Өөрийнхөө зохиосон орчуулга нь таны 30,000 токен өдөр тутмын нөөц дээр үнэгүй ажиллана; үнэтэй загварууд нь $1-ээс эхлэн нэмэх боломжтой.

MP3, WAV, M4A, FLAC, OGG, мөн видео (MP4, MOV, WebM) - дууг татаж авна. Нэг өргөтгөлд 500 МБ хүртэл. Хэт урт файлууд? /audio/cut/ эсвэл /v1/stt/batch/ ашиглан хуваана.

Хөгжмийн зохиолчдын диариз нь тусгай дамжуулалт юм - /transcribe/ дээр "diarize" -ийг соль. Fal Speech-to-Text нь бичлэгийг удирддаг; диариз нь бүрэлдэхүүн хэсгүүдийг дуучин 1 / дуучин 2/ гэх мэтээр тэмдэглэдэг.

Тийм - /batch/ аудио файлын хавтсыг хүлээн авдаг. Бүх бичлэгүүд /account/?tab=history-д ордог. Хавтсыг хадгалах API-г ашигла.

Тийм - дууны бичлэгийг "Fal Speech-to-Text" загвартай /v1/stt/transcribe/ руу POST хийнэ. JSON текст + хэсгүүд + үгийн түвшний цаг хугацааны тэмдэглэгээг буцаана. /api/ нь бүрэн холбоостой.

Өөрийн сервертэй загварууд дууг GPU дээр хадгална; Premium нь DPA-тай дамжуулна. Хөгжмийн файлыг хуваалцах цонхны дараа устгадаг (24 цаг аннон, 7 хоног бүртгэлтэй). Бид таны оруулсан мэдээллийг ашиглахгүй.

Тийм ээ - Free.ai нь бичлэгийг бизнесийн зорилгоор ашиглах эрх олгодог. Та өөрийн өргөж авсан дууны эрхийг (өөрөө бичсэн, лицензтэй материал, эсвэл зөвшөөрөлтэй агуулга) авах хэрэгтэй.

Real-time factor is roughly 0.05-0.2× - a 60-minute podcast transcribes in 3-12 minutes. Premium models often finish faster. Use the queue button to close the tab.

Free.ai-ийг хайрладаг уу? Найзуудаа хэлж өгөөрэй!

Энэ хуудсыг үнэл