Transcripción gratuita de maratí

Transcribe el audio y el vídeo maratí al texto con AI. Rápido, preciso y gratuito.

Cómo funciona

  1. Ve a la Transcriptor Free.ai
  2. Cargar el archivo de audio o vídeo maratí
  3. Nuestra IA detecta automáticamente maratí y la transcribe
  4. Descarga tu transcripción como texto o subtítulos SRT

Características de la transcripción de maratí

  • ✓Funciona con faster-whisper (con licencia del MIT)
  • ✓Detección automática de lenguaje maratí
  • ✓Soporta MP3, WAV, MP4, M4A, FLAC y más
  • ✓Marcas de tiempo y exportación de subtítulos (SRT)
  • ✓No hay límites de tamaño de archivo en los planes de pago
  • ✓Privado y seguro -- los archivos se eliminan después de procesar

Detalles del idioma

Idiomamaratí
Código ISOmr
Modelo AIfaster-whisper
PrecioLibre

Más idiomas

Ver todos los idiomas

Preguntas frecuentes

maratí es un lenguaje de recursos medios para Whisper - tierras de gran tamaño-v3-turbo en la banda de error de palabra 15-25%. La esencia de la transcripción es confiable; espere errores de entidad con nombre, fallos ocasionales de conmutación de código y fallas de corta brumancia. Planee un pase humano para la salida de calidad de publicación.(Tier C, 15-25% word error rate en los conjuntos de referencia - publicamos niveles honestos de WER en lugar de reclamaciones de marketing.)

Sí - maratí transcripción dibuja de su piscina token gratis diario primero. El audio cuesta alrededor de 50 tokens por minuto, por lo que la piscina diaria anónima cubre unas horas de audio por día. Cuentas firmadas obtener un mayor de 30.000 tokens de piscina diaria. Pasado eso, transcripción es de pago como usted-go, con token recargas de $1.

Las transcripciones de maratí se devuelven en el script Devanagari (UTF-8).

MP3, WAV, M4A, FLAC, OGG, OPUS, and WEBM are accepted directly. For video (MP4, MOV, MKV) we extract the audio track server-side before sending it to Whisper - you do not need to convert anything yourself. Same pipeline regardless of source language, including maratí.

El límite de carga anónimo es de aproximadamente 500 MB por archivo. Las cuentas firmadas llegan a 2 GB. La duración no es un límite difícil: los archivos largos se trocean automáticamente (ventanas de 30 segundos con superposición) y se suturan en una sola transcripción con marcas de tiempo continuas. Las grabaciones multihora maratí (podcasts, conferencias completas, reuniones) funcionan bien.

Sí - diarización de altavoz está encendido por defecto para cada transcripción maratí. La salida se segmenta como altavoz 1 / altavoz 2 / altavoz 3 con marcas de tiempo, por lo que las entrevistas, debates de panel y reuniones multipartitas vuelven etiquetados. Diarización se ejecuta en un modelo separado y funciona de la misma manera en todos los idiomas que soportamos.

Sí — pega la URL en /transcribe/youtube/ para YouTube o /transcribe/podcast/ para las fuentes de podcast (Apple, Spotify, RSS). Descargamos el audio, lo ejecutamos a través de Whisper con lenguaje=mr, y devolvemos la transcripción con marcas de tiempo y etiquetas de altavoz. Típico maratí content: Las notas de voz de WhatsApp, los vlogs de YouTube y el vídeo de forma corta son las cargas de trabajo más comunes de maratí - pegar una URL en /transcribir/youtube/ o subir el audio directamente.

Whisper cuesta alrededor de 50 tokens por minuto de audio, por lo que una grabación de una hora es ~3,000 tokens. La mayoría de los usuarios nunca gastan nada - el grupo diario gratuito de 30.000 tokens cubre clips cortos, notas de voz y podcasts únicos. Más allá de ello, la transcripción es de pago como se va, con recargas de tokens de $1.

Sí - tanto el nivel de segmento (cada ~10-30 segundos) y las marcas de tiempo de nivel de palabra están disponibles. Nivel de palabra es el valor predeterminado para la exportación de subtítulos VTT/SRT para que los subtítulos sincronicen línea por línea. En el API set timestamps="word" en el cuerpo de la petición. Las transcripciones de maratí se devuelven en el script Devanagari (UTF-8).

Sí. Audio POST (multipart/form-data, nombre de campo "file") a /v1/transcribir/ con language=mr - o bien omitir el parámetro idioma para permitir que Whisper autodetecte. Devuelve JSON con la transcripción, segmentos, marcas de tiempo y etiquetas de altavoz.

Sí - una vez que la transcripción termina, haga clic en Traducir o pegar el texto en /translate/. maratí pares con cada otro idioma que soportamos (200+). Para los minutos de reunión pipe la transcripción a través de /summarize/; para doblaje enviarlo a /voice/tts/ para renderizar audio en el idioma de destino.

La robustez del ruido de Whisper todavía se aplica en maratí, pero en este nivel de precisión cualquier ruido adicional compone la tasa de error de referencia. Audio de auriculares limpios da resultados notablemente mejores que las grabaciones de teléfono o micrófono portátil.Si una transcripción vuelve inutilizable, envíe un correo electrónico a contact@free.ai con el archivo - le devolveremos los tokens y ver si un motor diferente maneja mejor su audio.

¿Ama a Free.ai? ¡Dile a tus amigos!

Calificar esta página