ElevenLabs STT

Free.ai · stt · ~500 жетони по minute

Испушти аудио или видео датотека, или вметни URL долу

~500 жетони по minute
Бесплатно е со нашите ГПУ. Надоградба за ElevenLabs STT →

ElevenLabs STT е a модел за говор- во- текст. Преминува низ надворешни модели - ~500 tokens во минута (50% маркирање над цената на струјата).

Користи преку API

РЕЗУТИ РЕЗУЛТАЦИЈА со OpenAI. Генерирајте клуч и повикајте го овој модел за секунди.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"premium/elevenlabs/speech-to-text","audio_url":"https://..."}'
API документација Земи API- клуч

Често поставувани прашања

ElevenLabs STT ги препишува изговорените аудио во текст. Вчитај MP3, WAV, M4A или видео датотека и ElevenLabs STT го враќа целосниот транскрипт плус опционални SRT/ VTT преводи со временски табели.

ElevenLabs STT handles dozens of languages - Whisper-family models cover 90+, others vary. Pick "auto-detect" or specify the language for highest accuracy.

Стапката на зборови-тероризам е 5-10% на чист англиски аудио, 10-20% на бучен или акцентиран аудио. Големите варијанти на истата архитектура имаат значајно подобро во тешки случаи - одбери поголемо кога аудиото е грубо.

Да - секој сегмент вклучува почетни/ крајни временски знаци. Изнеси го како SRT или VTT и мапата на времето директно на вашето видео.

ElevenLabs STT е премиум транскрипциски мотор. Околу ~500-1,500 жетони во минута на аудио, прикажани во живо пред да генерирате. Самодомаштен транскрипциски препис работи бесплатно на вашиот дневен базен од 30.000 такни; премиум моделите се платени како што можете, со топ-аутоапс од $1.

MP3, WAV, M4A, FLAC, OGG, плус видео (MP4, MOV, WebM) - го вадиме аудиото. Макс. 500 MB по сечило. Подолги датотеки? Подели со / audio/cut/ или користете / v1/stt/ batch /.

Диализацијата на звучникот е одделно пасош - вклучи го „диаризирај“ на /transcribete/. ElevenLabs STT управува со транскрипцијата; дијаризацијата на секоја сегмент со спикер 1 / спикер 2 / итн.

Да - / batch/ прифаќа папка со аудио датотеки. Секоја преписка слетува во / account /?tab=историја со оригиналното име на датотеката. За зачувување на папки- дрвото користи API.

Да - ПОСТ на вашиот аудио на / v1/stt/ transcribe/ со модел=" ElevenLabs STT". Ја враќа JSON со текст + сегменти + временски означувачи на зборно ниво. /api/ ја има целосната референца.

Самодомаќинските модели чуваат аудио на нашите ГПУ; премиумот поминува со DPA. Аудиото се избриша по споделуваниот прозорец (24h anon, 7d потпишано). Не тренираме за вашите влези.

Да - Free.ai доделува комерцијална употреба на транскрипти. Ви требаат права на аудиото што го качивте (своето сопствено снимање, лиценца материјал или содржина со согласност).

Факторот во реално време е околу 0.05-0.2× - 60-минутен транскрипт за подемисија за 3-12 минути. Премиум моделите често завршуваат побрзо. Користете го копчето за да го затворите ливчето.

Like this tool? Share it!

Оцени ја оваа страница