Transcripción libre éuscaro

Transcreba o son e vídeo éuscaro a texto coa IA. Rápido, preciso e gratuíto.

Como funciona

  1. Ir ao Transcriptor Free.ai
  2. Envíe o seu ficheiro de son ou vídeo éuscaro
  3. A nosa IA detecta automaticamente éuscaro e transcríbea
  4. Obteña a súa transcrición como texto ou subtítulos SRT

Características de transcrición éuscaro

  • ✓Desenvolvido por faster-whisper (con licenza MIT)
  • ✓Detección automática da lingua éuscaro
  • ✓Soporta MP3, WAV, MP4, M4A, FLAC e máis
  • ✓Exportación de marcas de tempo e subtítulos (SRT)
  • ✓Non hai límites de tamaño de ficheiro nos plans de pago
  • ✓Privado e seguro -- os ficheiros bórranse despois do procesamento

Detalles da lingua

Linguaéuscaro
Código ISOeu
Modelo de IAfaster-whisper
PrezoLibre

Máis idiomas

Ver todas as linguas

FAQ

éuscaro é unha linguaxe con menos recursos para Whisper - large- v3- turbo ten unha taxa de erros de palabra superior ao 25%, ás veces moito máis. A transcrición é útil para procurar e facer o gist, pero non debe ser tratada como lista para publicar. Se hai un motor de maior precisión dispoñíbel para éuscaro, introducimos automaticamente a transcrición.(Tier D, over 25% word error rate en conxuntos de referencia - publicamos niveis honestos de WER en lugar de reclamacións de mercadotecnia.)

Yes - éuscaro transcription draws from your daily free token pool first. Audio costs about 50 tokens per minute, so the anonymous daily pool covers a few hours of audio per day. Signed-in accounts get a larger 30,000-token daily pool. Past that, transcription is pay-as-you-go, with token top-ups from $1.

As transcricións éuscaro devólvense en UTF- 8 estándar coa ortografía normal da lingua.

Acéptanse directamente MP3, WAV, M4A, FLAC, OGG, OPUS e WEBM. Para os vídeos (MP4, MOV, MKV) extraemos a pista de son do servidor antes de enviala a Whisper - non precisa converter nada. O mesmo canle independentemente da lingua de orixe, incluíndo éuscaro.

O límite máximo de envío anónimo é de aproximadamente 500 MB por ficheiro. As contas rexistradas chegan a 2 GB. A duración non é un límite ríxido - os ficheiros longos son divididos automaticamente (fendas de 30 segundos con superposición) e unidos nunha única transcrición con marcas de tempo continuas. As gravacións de éuscaro de varias horas (podcasts, conferencias completas, reunións) funcionan ben.

Si - a diarización do falante está activada por omisión para cada transcrición éuscaro. A saída é segmentada como Falante 1 / Falante 2 / Falante 3 con marcas de tempo, polo que as entrevistas, discusións de panel e reunións multipartito regresan etiquetadas. A diarización funciona nun modelo separado e funciona igual en todas as linguas que soportamos.

Si - apega o URL en / transcribe/ youtube/ para YouTube ou / transcribe/ podcast/ para fontes de podcast (Apple, Spotify, RSS). Obtemos o son, executámolo a través de Whisper con language=eu e devolvemos a transcrición con marcas de tempo e etiquetas de orador. O contido típico de éuscaro é: conferencias, entrevistas, notas de voz e contido de YouTube en éuscaro funcionan todos - apegue un URL en / transcribe/ youtube / ou envíe o ficheiro directamente.

Whisper costs about 50 tokens per minute of audio, so a one-hour recording is ~3,000 tokens. Most users never spend anything - the free daily pool of 30,000 tokens covers short clips, voice notes, and one-off podcasts. Beyond it, transcription is pay-as-you-go, with token top-ups from $1.

Si, están dispoñíbeis marcas de tempo tanto a nivel de segmento (cada ~10- 30 segundos) como a nivel de palabra. O nivel de palabra é o predeterminado para a exportación de subtítulos VTT/ SRT, polo que os subtítulos sincronízanse liña por liña. Na API estabeleza timestamps=" word "no corpo da solicitude. As transcricións éuscaro devólvense en UTF- 8 estándar coa ortografía normal da lingua.

Si. POST audio (multipart/ form- data, campo nome "ficheiro") a / v1/ transcribe / con language=eu - ou omita o parámetro de lingua para permitir a detección automática de Whisper. Devolve JSON coa transcrición, segmentos, marcas de tempo e etiquetas de orador. Referencia completa e fragmentos de SDK en / api /.

Si - unha vez rematada a transcrición, prema Traducir ou apegue o texto en / translate /. éuscaro emparéllase con todas as outras linguas que soportamos (máis de 200). Para as actas das reunións, a transcrición pasa por / summarize /; para a dobraxe envíase a / voice/ tts / para reproducir o son na lingua de destino.

O adestramento de ruído de Whisper axuda menos neste nivel - o cuello de botella é a cantidade de son éuscaro que Whisper viu durante o adestramento, non o ruído. O son limpo de estudio aínda é mellor que o ruído, pero ningún dos dous alcanzará a precisión que se obtería nunha linguaxe de recursos altos.Se unha transcrición non se pode usar, envíe un correo electrónico a contact@free.ai co ficheiro - devolveremos os tokens e veremos se un motor diferente manexa mellor o seu son.

Amas a Free.ai?

Cualificar esta páxina