Moonshine Base

Free.ai (self-hosted) · stt · ~500 жетони по minute

Испушти аудио или видео датотека, или вметни URL долу

~500 жетони по minute

Moonshine Base е a модел за говор- во- текст изграден од Useful Sensors. Најсилно во Low-latency live transcription, embedded devices.. Само домаќин на Free.ai ГПУ — трча бесплатно против вашиот дневен жетонски базен (500 žeтони во минута). Ослободен под MIT - комерцијална употреба дозволена на Free.ai.

Користи преку API

РЕЗУТИ РЕЗУЛТАЦИЈА со OpenAI. Генерирајте клуч и повикајте го овој модел за секунди.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"moonshine-base","audio_url":"https://..."}'
API документација Земи API- клуч

Често поставувани прашања

Moonshine Base ги препишува изговорените аудио во текст. Вчитај MP3, WAV, M4A или видео датотека и Moonshine Base го враќа целосниот транскрипт плус опционални SRT/ VTT преводи со временски табели.

Moonshine Base handles dozens of languages - Whisper-family models cover 90+, others vary. Pick "auto-detect" or specify the language for highest accuracy.

Стапката на зборови-тероризам е 5-10% на чист англиски аудио, 10-20% на бучен или акцентиран аудио. Големите варијанти на истата архитектура имаат значајно подобро во тешки случаи - одбери поголемо кога аудиото е грубо.

Да - секој сегмент вклучува почетни/ крајни временски знаци. Изнеси го како SRT или VTT и мапата на времето директно на вашето видео.

Moonshine Base работи на нашите GPU-ови прво против вашиот дневен бесплатни базен; 5 → 200.000 платени жетони после тоа. Околу ~500 жетони во минута.

MP3, WAV, M4A, FLAC, OGG, плус видео (MP4, MOV, WebM) - го вадиме аудиото. Макс. 500 MB по сечило. Подолги датотеки? Подели со / audio/cut/ или користете / v1/stt/ batch /.

Диализацијата на звучникот е одделно пасош - вклучи го „диаризирај“ на /transcribete/. Moonshine Base управува со транскрипцијата; дијаризацијата на секоја сегмент со спикер 1 / спикер 2 / итн.

Да - / batch/ прифаќа папка со аудио датотеки. Секоја преписка слетува во / account /?tab=историја со оригиналното име на датотеката. За зачувување на папки- дрвото користи API.

Да - ПОСТ на вашиот аудио на / v1/stt/ transcribe/ со модел=" Moonshine Base". Ја враќа JSON со текст + сегменти + временски означувачи на зборно ниво. /api/ ја има целосната референца.

Самодомаќинските модели чуваат аудио на нашите ГПУ; премиумот поминува со DPA. Аудиото се избриша по споделуваниот прозорец (24h anon, 7d потпишано). Не тренираме за вашите влези.

Да - Free.ai доделува комерцијална употреба на транскрипти. Ви требаат права на аудиото што го качивте (своето сопствено снимање, лиценца материјал или содржина со согласност).

Факторот во реално време е околу 0.05-0.2× - 60-минутен транскрипт за подемисија за 3-12 минути. Премиум моделите често завршуваат побрзо. Користете го копчето за да го затворите ливчето.

Like this tool? Share it!

Оцени ја оваа страница