Transcription par podcast

Utilisation commerciale OK modèles 581 Pas de filigrane Pas besoin d'inscription
Modèle:
+ GPT-5, Claude, Gemini
Téléchargez un épisode de podcast et obtenez une transcription propre, marquée par haut-parleur avec des marqueurs de chapitre détectés automatiquement à partir de lacunes de silence. Fichiers de forme longue jusqu'à 2 Go, 99 langues, Whisper-large-v3 précision. Exporter en tant que SRT/VTT pour votre podcast vidéo, TXT simple pour les notes de présentation, ou JSON pour l'édition dans les workflows de style Descript.

Faites glisser et déposez votre épisode de podcast, ou cliquez pour parcourir

MP3, WAV, M4A, OGG, MP4 — épisodes de forme longue jusqu'à 2 Go

- - - -
Les marqueurs de chapitre sont calculés à côté des lacunes du segment et attachés à la transcription. Collez-les dans YouTube ou Spotify descriptions telles quelles.
Estimation symbolique pour ce clip
-
Transcription baladodiffusion
Chapitres détectés automatiquement

Tracing de votre podcast...

Les épisodes longs prennent plusieurs minutes. Vous pouvez fermer cet onglet si email-quand-doine est cochée.

Construit pour podcasters + éditeurs de spectacles

Afficher les notes dans une seule pâte

Téléchargez l'épisode, téléchargez les étiquettes TXT. Speaker en ligne, les horodatages du chapitre sont prêts pour votre description Spotify/YouTube, le blog est écrit en 10 minutes au lieu de 4 heures.

Sous-titres de podcast vidéo

Exportez SRT ou WebVTT avec les étiquettes de haut-parleurs. Déposer directement dans Premiere, Final Cut ou DaVinci Resolve — ou télécharger avec votre vidéo YouTube pour les légendes propres.

Révision d'épisodes par texte

L'export JSON vous donne chaque mot avec des horodatages start/end. Pipe dans le Descript, Reaper, ou un workflow personnalisé — modifier en mettant en évidence le texte au lieu de frotter.

Comment fonctionne la transcription podcast

  1. Faites glisser votre épisode sur la zone de dépôt — MP3, WAV, M4A, MP4, jusqu'à 2 Go.
  2. Laissez les étiquettes des haut-parleurs et les marqueurs de chapitre allumés (ils sont les valeurs par défaut).
  3. Nous vérifions la durée + le prix avant de dépenser des jetons. Cliquez sur Transcribe.
  4. Télécharger le haut-parleur TXT, SRT, VTT ou JSON. Les marqueurs de chapitre sont livrés à côté, prêts à coller.

Transcription de la baladodiffusion Free.ai vs Descript, Riverside, Otter

Fonctionnalité Free.ai Descript Riverside Otter.ai
PrixPay-per-use ($0.003/min)$15-30/mo$19/mo$16.99/mo
Taille maximale du fichier2 GB5 GBTied to record session500 MB (varies)
Diarisation des orateurs
Marqueurs de chapitre automatique (fondé sur la silence)Manual-Paid tier
Exportations de TTS/TTVPaid
Langues9922100+English-focused
API publique--Limited
Les prix des concurrents reflètent les niveaux cotés en bourse en 2026. Vérifiez chaque fournisseur pour connaître les plans actuels.
Options avancées
Résultat
Les jetons sont bas. Obtenez plus de jetons
Vous voulez de meilleurs résultats? Modèles Premium (GPT-5, Claude, Gemini) offrent une qualité supérieure. Afficher les plans

❤️ Aimez Free.ai? Dites à vos amis!

Inscrivez-vous pour obtenir un lien de référence et gagner 30 000 jetons par ami.

Tu en veux plus? Inscription gratuite: 30 000 jetons/jour
Inscription gratuite

Traitement de votre demande...

Tracez gratuitement les podcasts en texte avec AI. Étiquettes haut-parleurs, marqueurs de chapitre, exportation SRT.

Comment utiliser Transcription par podcast

1
Saisissez votre entrée

Tapez du texte, téléchargez un fichier ou décrivez ce que vous voulez. Pas de compte nécessaire.

2
Cliquez sur générer

Notre AI traite votre demande en quelques secondes en utilisant les meilleurs modèles open-source.

3
Télécharger & partager

Téléchargez, copiez ou partagez votre résultat. Gratuit pour un usage personnel et commercial.

Utilisez cet outil via API

Automatisez cet outil à partir de votre propre code. Endpoint REST compatible OpenAI, Auth-token de porteur, pas de SDK supplémentaire requis.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"file": "@audio.mp3", "language": "auto"}'

Transcription par podcast - FAQ

Transcription par podcast de podcast par défaut pour la diarisation des haut-parleurs et les marqueurs de chapitre (détection de la faille de silence >2s), et prend en charge les fichiers de longue durée jusqu'à 2 Go. Les formats de sortie incluent SRT + VTT pour les clips vidéo de shownotes, TXT simple pour les messages de blog, et JSON structuré avec des horodatages par tour + étiquettes de haut-parleur pour l'édition dans les workflows de style Descript.

Jusqu'à 2 Go par fichier - environ 14 heures de podcast audio à 128 kbps MP3. Les fichiers longs sont coupés côté serveur pour la résilience; vous obtenez une seule transcription fusionnée.

Oui. La diarisation des haut-parleurs est ON par défaut. Nous détectons 2-10 voix distinctes via les embarquations vocales ECAPA, les étiquetons Haut-parleur 1 / 2 /... et appliquons les étiquettes à chaque segment. Vous pouvez les renommer dans la vue des résultats.

Silence s'écarte plus de 2 secondes - les podcasters se cassent naturellement entre les segments. Chaque chapitre reçoit un horodatage que vous pouvez coller directement dans vos notes avec un bloc "Chapitres:" pour YouTube + Spotify.

Descript charges $15-$30 per month for 10 hours of transcription, tied to their editor. We charge per-use at ~500 tokens/min on Whisper ($5 = 200K tokens = ~400 minutes), no subscription, plain export you can paste anywhere.

Riverside est un studio d'enregistrement qui transcrit vos propres sessions gratuitement dans leur application, mais seulement après avoir enregistré avec eux. Nous transcrivons tout MP3/WAV/MP4 quel que soit l'endroit où il a été enregistré.

Otter caps at 300 minutes/month on the free tier and is English-focused. We support 99 languages at the same Whisper-large-v3 accuracy with no monthly cap - you pay per minute transcribed.

Oui - choisissez SRT ou WebVTT comme format de sortie. Les étiquettes de haut-parleur sont incluses en ligne (SRT) ou comme <v Speaker N> tags (VTT) que la plupart des joueurs modernes rendent correctement.

Whisper-large-v3 gère bien les lits de musique et la réverbération légère (taux d'erreur de mot typique 3-7%). La musique très forte ou le chevauchement lourd dégrade la précision - envisager de courir /musique/vocal-remover/ d'abord sur une copie, ou de diviser vos ouvertures froides.

Whisper gère la plupart des noms courants, mais jargon hautement spécifique de marque peut avoir besoin d'un passe post-édition. Un épisode ~30 minutes a généralement 5-10 corrections de marque/nom à appliquer manuellement.

Téléchargez-les un à un ici, ou utilisez notre fonction /batch/ une fois connecté pour faire la queue en cours de saison. L'API de /api/ accepte également POST /v1/stt/ pour le batch programmatique.

Non. Les fichiers téléchargés sont supprimés après la transcription complète. Votre transcription est dans votre /account/ historique à télécharger si vous êtes connecté; les utilisateurs anonymes obtiennent un lien de partage 24 heures sur 24.

Inscription gratuite: 30 000 jetons/jour

Créer un compte gratuit

Aucune carte de crédit requise

Comment évalueriez-vous cet outil?

Aimez Free.ai? Dites à vos amis!