Moonshine Base

Free.ai (self-hosted) · stt · ~500 Torneiras por minute

Deixe um arquivo de áudio ou vídeo ou cole uma URL abaixo

~500 Torneiras por minute

Moonshine Base é a modelo de fala a texto construído por Useful Sensors. A mais forte em Low-latency live transcription, embedded devices.. Self-hosted on Free.ai GPUs — corre livre contra a sua piscina cotidiana de tokens (500 tokens por minuto). Lançado sob MIT - uso comercial permitido em Free.ai.

Utilizar através da API

API REST compatível com a OpenAI. Gere uma chave e chame este modelo em segundos.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"moonshine-base","audio_url":"https://..."}'
Documentação da API Obter a chave da API

Perguntas Frequentes

Moonshine Base transcribe áudio falado em texto. Envie um arquivo MP3, WAV, M4A ou vídeo e Moonshine Base retorna a transcrição completa mais legendas SRT/VTT opcionais com selos de tempo.

Moonshine Base handles dozens of languages - Whisper-family models cover 90+, others vary. Pick "auto-detect" or specify the language for highest accuracy.

A taxa de erro de palavra é de 5 a 10% em áudio de inglês limpo, 10 a 20% em áudio ruidoso ou acentuado. Grandes variantes da mesma arquitetura fazem significativamente melhor em casos rígidos - escolher maior quando o áudio é ruvido.

Sim - cada segmento inclui selos de tempo inicial/final. Exporte como SRT ou VTT e o mapa de tempos diretamente no seu vídeo.

Moonshine Base funciona em nosso próprio GPUs contra o seu diário piscina grátis primeiro; $5 → 200.000 fichas pagas depois disso. Cerca de ~500 fichas por minuto.

MP3, WAV, M4A, FLAC, OGG, mais vídeo (MP4, MOV, WebM) - extraimos o áudio. Máximo 500 MB por upload. Arquivos mais longos? Dividir com /audio/cut/ ou usar /v1/stt/batch /.

A diarização do alto-falante é um passe separado - commutar "diarizar" em /transcribe /. Moonshine Base maneja a transcrição; etiquetas de diarização cada segmento com Speaker 1 / Speaker 2 / etc.

Sim - /batch/ aceita uma pasta de arquivos de áudio. Cada transcrição terras em /account /?tab=história com o nome de arquivo original. Para a preservação de pasta-árbore use a API.

Sim - POST seu áudio para /v1/stt/transcribe/ com model="Moonshine Base". Devolve JSON com texto + segmentos + selos de tempo de nível de palavra. /api/ tem a referência completa.

Os modelos auto-hostados mantêm áudio em nossas UCP; premium passa com um DPA. O áudio é excluído após a janela de compartilhamento (24h anon, 7d assinado). Não treinamos em seus insumos.

Sim - Free.ai concede uso comercial de transcrições. Você precisa de direitos para o áudio que você enviou (o seu próprio registro, material licenciado ou conteúdo com consentimento).

Fator em tempo real é aproximadamente 0,05-0,2× - um podcast de 60 minutos transcribe em 3-12 minutos. Os modelos premium muitas vezes acabam mais rápido. Use o botão cola para fechar a aba.

Adoro Free.ai? Diga aos seus amigos!

Avaliar esta página