Speech to Text

Коммерческое использование Модели 579 Нет водяного знака Не нужно подписываться
Модель:
+ GPT-5, Claude, Gemini
Upload an audio or video file - or paste a URL - and get a clean transcript with timestamps. Speaker diarization, SRT/VTT subtitle export, 100+ languages with auto-detect. Cost scales exactly with clip length. Powered by Whisper large-v3-turbo (self-hosted), plus premium Wizper and ElevenLabs STT.

Перетащите и сбрасывайте аудио/видео или щелчните для просмотра

MP3, WAV, MP4, WebM, M4A - до 500 МВт

- - -
Whisper крупногабаритный-v3 - 99 языков, наиболее высокая точность в классе.
Расчетный объем этой клипа
-
Безымянный номер: 30 К/день Покупка символов
YouTube, Instagram, TikTok, Spotify и 1300+ платформ
Стоимость транскрипции URL основана на фактической продолжительности клипа — мы цитируем после загрузки. Ожидайте ~500 токенов/мин.
Запись: 0:00

Запись в реальном времени с помощью микрофона

Переписка

Записи аудио...

Это может занять время для более длинных файлов.

Что люди пишут Free.ai

Интервью + подкасты

Вывозите SRT прямо в ваш редактор видео, или обычный текст для записи статей.

Автозаголовки + субтитры

Загрузить загрузку на YouTube или TikTok, выбрать SRT или WebVTT и сжечь субтитры с помощью /видео/subject/.

Примечания для заседаний

Upload a Zoom/Teams recording - get transcript + speaker labels. Pair with /write/summarize/ for bullet-point minutes.

Лекции + уроки

Переписать 90-минутную лекцию, затем использовать/учебные/флэш-карты/ или/писать/краткое описание/сделать ее в учебные материалы.

Звуко на иностранном языке

Whisper auto-detects 99 languages. Transcribe in the original, then send the text through /translate/ to jump languages.

Юридический + медицинский

Время, ярлыки ораторов, экспорт JSON с каждым словом в начале/конечном времени — точный суд-репортер или клиническая подготовка.

Как Free.ai сравнивается

Что ты получишь Free.ai Otter.ai Descript Rev.com
Бесплатное ежедневное использование5K+ tokens/day300 minutes/mo1 hr/month-
ДвигательWhisper large-v3-turboProprietaryProprietaryHuman + AI
Знание языков99English-focused2230+
Диарея спикера
Экспорт SRT/ VTTPaidPaid
Общественный АПИLimitedLimited
Щиты SPT (свободно) Paid--
Требуемая регистрацияНетYesYesYes
Данные о конкурентах отражают публично перечисленные бесплатные уровни по состоянию на 2026 год.
Дополнительные варианты
Результат
Токены закончились. Возьмите больше токенов
Хочешь получить результаты получше? Модели премиум (GPT-5, Claude, Gemini) обеспечивает более высокое качество. Просмотр

❤️ Love Free.ai? Tell your friends!

Подпишитесь , чтобы получить ссылку на направление и заработать 25 000 символов на друга.

Хочешь еще? Бесплатно подписывайтесь: 30 000 жетонов в день
Не подписываться

Обработка вашей просьбы...

Best free speech to text tool. Upload MP3, WAV, MP4 or record live. Auto-detect language. Speaker diarization. No sign up required.

Как пользоваться Speech to Text

1
Введите в себя

Наберите текст, загрузите файл или опишите, что вам нужно.

2
Нажмите на жёлтый набор

Наша АИ обрабатывает ваш запрос в секунды с использованием лучших моделей с открытым исходным кодом.

3
Загрузка & доли

Загрузить, скопировать или поделиться результатами.

Использовать этот инструмент через API

Автоматизировать этот инструмент из своего собственного кода. OpenAI-совместимый конечный пункт REST, Bearer-Tken Auth, не требуется дополнительных SDK. Токен расценки соответствует веб-интерфейсу.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"file": "@audio.mp3", "language": "auto"}'

Speech to Text - FAQ

Free.ai предлагает Whisper-сохранённую речь для текста с отличной точностью, 99 языков, экспорт субтитров, обнаружение громкости и живой микросхемы - абсолютно бесплатно.

Загрузить аудио- или видео файл (MP3, WAV, MP4, M4A), нажать на транскрипцию и получить точную речь к тексту в секунды.

Вставить любой URL на YouTube в вкладку URL и речь в текстовое средство вытаскивает звук и преобразует его. Работает с Instagram, TikTok, Spotify и 1300+ платформами.

Да, мы выбираем или обнаруживаем из 99 языков, а в нашей речи текст - акценты, фоновый шум и звуковой колодец с смешанным языком.

Выбрать несколько аудиофайлов одновременно - каждый из них отправляется через речь к тексту с отслеживанием хода работы, и результаты загружаются отдельно или в сочетании друг с другом.

Да. Слова к тексту API на /api/ совместимы с OpenAI. Загрузить звук программно и получить JSON с стенограммой, языком и временными метками.

Да. Обнаружение спикера перед загрузкой, а речь к текстовому выходу обозначается на каждого оратора (пикер 1, спикер 2..). Добавляет 50% к символической стоимости.

Слова для текстов принимают файлы до 500MB за загрузку. Для многочасового контента сначала поделите звук на кусочки.

Очень точная для ясного звука - обычно 95%+ точность слов на английском языке с нашей Whisper большой v3 спинной частью. Качество зависит от звуковой ясности, акцента и фонового шума.

Да. Запись полностью переработана. Исправьте ошибки, переформат и копирование/загрузка как TXT, SRT или VTT.

Да. Аудиозаписи обрабатываются на наших собственных GPU и удаляются после речи в текст. Ничего не хранится в течение длительного времени, не используется или не используется для обучения.

Загрузить аудио- или видео файл в /chat/ и попросить МА записать его - объединить речь с текстом с последующими вопросами и суммировать в одном рабочем потоке.

Бесплатно подписывайтесь: 30 000 жетонов в день

Создать свободный Аккаунт

Кредитная карта не требуется

Как бы вы оценили этот инструмент?

Love Free.ai? Tell your friends!