Fal Speech-to-Text

Free.ai · stt · ~500 Токендер minute

Аудио же видео файлды алып салыңыз же URL дарегин төмөндөгү жерге коюңуз

~500 Токендер minute
Биздин графикалык процессорлорубузда акысыз иштей алат. Жаңыртуу Fal Speech-to-Text →

Fal Speech-to-Text жана a Сөздөн-текшке модел. Тышкы моделдер аркылуу багытталган - ~500 tokens мүнөтүнө (50% маркупа над стоимостью).

API аркылуу колдонуу

OpenAI-ка ылайыктуу REST API. Ачкычтарды генерациялоо жана бул моделди секундаларда чакыруу.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"premium/speech-to-text","audio_url":"https://..."}'
Документация API ачкычын алуу

Кайра-кайра берилүүчү суроолор

Fal Speech-to-Text - аудиону текстке которуу программасы. MP3, WAV, M4A же видеофайлдарды жүктөп алыңыз, Fal Speech-to-Text толук транскрипцияны жана кошумча SRT/VTT субтитрлерин убакыт белгилери менен кайтарат.

Fal Speech-to-Text handles dozens of languages - Whisper-family models cover 90+, others vary. Pick "auto-detect" or specify the language for highest accuracy.

Сөз каталардын саны таза англис аудиосунда 5-10%, ызы-чуу же акцент менен жазылган аудиодо 10-20% түзөт. Бирдей архитектурадагы чоң варианттар татаал учурларда жакшы иштешет - аудио катуу болгондо чоңураак вариантты тандаңыз.

Ооба - ар бир сегментте башталыш/аялуу убактысы бар. Экспорт SRT же VTT форматында болот, ал эми убакыттар видеого түз эле жазылат.

Fal Speech-to-Text - бул премиум транскрипциялык машина. Бир мүнөттүк аудиодо ~500-1500 токен, сиз генерациялоодон мурун көрсөтүлөт. Өзүңүздүн хостингдеги транскрипция сиздин 30 000 токен күндүк пулуңузга акысыз иштейт; премиум моделдер колдонулган сайын төлөнөт, топтомо $1ден башталат.

MP3, WAV, M4A, FLAC, OGG, plus видео (MP4, MOV, WebM) - мы извлекаем аудио. Максимум 500 МБ за загрузку. Большие файлы? Разделите /audio/cut/ или используйте /v1/stt/batch/.

Сөйлөгөн адамдын диаризациясы өзүнчө өтүү - /transcribe/'де "diarize" дегенди тандаңыз. Fal Speech-to-Text транскрипцияны аткарат; диаризация ар бир сегментти сүйлөгөн адам 1 / сүйлөгөн адам 2 / ж.б. менен белгилейт

Да - /batch/ принимает папку аудиофайлов. Каждый транскрипт оказывается в /account/?tab=history с оригинальным файловым именем. Для сохранения папки используйте API.

Да - аудиону POST /v1/stt/transcribe/ менен model="Fal Speech-to-Text" деп. Текст + сегменттер + сөз деңгээлиндеги убакыт белгилери менен JSON кайтарат. /api/ толук шилтемеси бар.

Автономные модели сохраняют аудио на наших графических процессорах; премиум модели сохраняют аудио на наших графических процессорах; премиум модели сохраняют аудио на наших графических процессорах. Аудио после разделения окна (24 часа анон, 7 дней входа) удаляется. Мы не тренируем ваши вводные данные.

Да - Free.ai транскрипцияларды коммерциялык максатта колдонууга уруксат берет. Сизге жүктөп алган аудиону (өзүңүздүн жаздырууңуз, лицензияланган материал же уруксат берилген мазмун) колдонууга укук керек.

Реальный фактор времени составляет примерно 0.05-0.2× - 60-минутный подкаст транскрибируется в течение 3-12 минут. Премиум модели чаще всего заканчиваются быстрее. Используйте очередь кнопку для закрытия закладки.

Free.ai жактырган? Досторуңузга айтыңыз!

Бул барактын баасын баалоо