Cas d'usage

Transcrire un podcast : notes d'épisode, chapitres, citations et version anglaise

Pour transcrire un podcast, exportez l'épisode final en MP3 ou WAV, faites-le passer dans un outil de reconnaissance vocale, puis relisez le texte en ajoutant vous-même le nom des intervenants. Ce texte devient ensuite la matière de vos notes d'épisode, de vos chapitres, de vos citations et, si vous le souhaitez, d'une version anglaise.

8 min de lecture · Mis à jour

À noter : l'interface de mydubly est en anglais. La transcription d'un audio en français, la traduction vers le français et la voix française fonctionnent ; seuls les boutons sont libellés en anglais.

Ce qu'une transcription apporte à un podcast

Un épisode audio est difficile à exploiter tel quel : on ne peut ni le parcourir d'un coup d'œil, ni y chercher une phrase, ni le citer proprement. Une fois en texte, le même épisode alimente presque tout ce qui entoure la diffusion.

  • Les notes d'épisode : résumé, liens évoqués, ouvrages cités, invités présentés.
  • Les chapitres : repères horodatés qui permettent à l'auditeur de sauter au sujet qui l'intéresse.
  • Les citations : phrases fortes pour Instagram, LinkedIn ou la newsletter, recopiées sans les déformer.
  • L'accessibilité : une transcription publiée permet aux personnes sourdes ou malentendantes de suivre l'épisode.
  • Le référencement : un moteur de recherche lit du texte, pas de l'audio. Une page d'épisode avec un vrai contenu écrit a plus de chances d'être trouvée.
  • La traduction : un texte se traduit bien plus facilement qu'un fichier son, ce qui ouvre la porte à une version anglaise.

Tous les podcasts n'ont pas besoin de tout cela. Une émission de conversation entre amis profitera surtout des chapitres et des citations ; un podcast de vulgarisation scientifique, de notes détaillées et d'une transcription complète en ligne.

Préparer le bon fichier avant de transcrire

La qualité du texte dépend d'abord de la qualité du son. Quelques réflexes évitent beaucoup de corrections.

  • Transcrivez l'épisode final mixé, pas la session brute : les silences, faux départs et digressions coupés au montage n'encombreront pas le texte.
  • Exportez en MP3, WAV, M4A, AAC, OGG ou FLAC depuis votre logiciel de montage. Un MP3 en bon débit suffit largement pour de la parole.
  • Si votre émission est hébergée chez un diffuseur, partez du fichier original conservé sur votre disque plutôt que de chercher à récupérer la version publiée.
  • Les génériques musicaux ne gênent pas, mais une musique de fond forte sous les voix complique la reconnaissance.
  • Un épisode long n'est pas un problème tant qu'il reste sous 2 heures ; au-delà, coupez-le en deux parties.

Si vous enregistrez chaque micro sur une piste séparée, gardez ces pistes : elles serviront à identifier les intervenants, comme expliqué plus bas.

Transcrire l'épisode avec mydubly : déroulé et limites

mydubly propose un espace audio dédié, présenté sur la page audio en texte (en anglais). Le déroulé tient en quelques gestes :

  1. Déposez le fichier dans la zone « Drop audio here ».
  2. Laissez l'interrupteur « Audio and text output » désactivé : vous êtes alors en mode transcription seule.
  3. Cliquez sur « Transcribe audio » et gardez l'onglet ouvert pendant le traitement.
  4. Téléchargez le texte brut avec « Download transcript » et la version avec repères temporels avec « Download timestamped transcript ».

La langue parlée est détectée automatiquement : vous ne la choisissez pas. La reconnaissance s'appuie sur Whisper, un modèle open source, avec une détection d'activité vocale qui saute les silences. L'audio est envoyé en HTTPS et supprimé du serveur dans les 30 minutes qui suivent la fin du travail.

Coût d'un épisode

Un épisode de 60 minutes transcrit coûte 60 crédits, soit $0,06. Les 100 crédits offerts à l'inscription couvrent donc un épisode d'une heure, et il en reste 40. Pour une capsule de 3 minutes, le minimum de 5 crédits par fichier s'applique.

Ce que mydubly ne fait pas pour un podcasteur : il n'identifie pas les intervenants, ne rédige pas de résumé ni de notes d'épisode, ne propose pas d'éditeur pour corriger le texte (vous corrigez le fichier téléchargé dans votre traitement de texte habituel) et n'importe rien depuis un lien : il faut le fichier sur votre appareil. Si votre podcast est filmé, déposez plutôt la vidéo dans l'espace vidéo pour obtenir aussi un fichier de sous-titres SRT.

Identifier les intervenants à la main

La transcription arrive en un seul bloc, sans « ANIMATRICE : » ni « INVITÉ : ». C'est le travail qui prend le plus de temps à la relecture, mais il existe des méthodes efficaces.

  1. Repérez les changements de voix : relancez l'audio à chaque question, chaque « oui, alors… », chaque rire de réaction. Les repères temporels du fichier horodaté vous amènent directement au bon moment.
  2. Adoptez une convention simple et tenez-vous-y : prénom en majuscules suivi de deux-points, nouveau paragraphe à chaque prise de parole.
  3. Utilisez la structure de l'émission : dans un format interview, les questions courtes reviennent presque toujours à l'animateur.
  4. Si chaque micro a sa propre piste, transcrivez chaque piste séparément : chaque fichier ne contient alors qu'une voix, et il ne reste qu'à fusionner les deux textes dans l'ordre des horodatages.
Calcul pour deux pistes

Une interview d'une heure enregistrée sur deux pistes séparées : 2 × 60 = 120 crédits, soit $0,12. Attention à la repisse : si la voix de l'invité s'entend faiblement dans le micro de l'animateur, quelques mots peuvent apparaître dans les deux transcriptions.

Pour comprendre pourquoi cette tâche est difficile à automatiser, lisez notre article sur l'identification des locuteurs (en anglais).

Des notes d'épisode aux chapitres

Une fois le texte relu, la rédaction des notes d'épisode devient un travail de sélection plutôt que de réécoute. Une structure qui fonctionne bien :

  • Deux ou trois phrases d'accroche qui disent de quoi parle l'épisode et pourquoi l'écouter.
  • La présentation de l'invité, vérifiée avec lui (titre, orthographe du nom, liens).
  • Les ressources citées : livres, études, sites, avec l'orthographe exacte, que la transcription aide à retrouver.
  • Les chapitres horodatés.

Pour les chapitres, parcourez la transcription horodatée et notez le moment où chaque grand sujet commence. Visez des intitulés courts et concrets plutôt que « Partie 2 ».

Exemple de chapitrage

00:00 Présentation de l'invitée · 03:40 Pourquoi elle a quitté l'industrie agroalimentaire · 15:10 Monter une conserverie artisanale en Bretagne · 32:25 Les erreurs de la première année · 47:00 Ses conseils pour se lancer (dans la description, une ligne par chapitre)

Sur YouTube, une liste de ce type dans la description, commençant à 00:00, crée des chapitres dans la barre de lecture. Chez les hébergeurs de podcast, la prise en charge des chapitres varie : vérifiez la documentation du vôtre. Notre article sur les notes d'épisode tirées d'une transcription (en anglais) propose d'autres modèles.

Citations et extraits : rester fidèle à l'oral

Le français parlé n'est pas le français écrit. Une transcription fidèle contient des « ben », des « du coup », des « en fait », des phrases reprises en cours de route. Pour une citation publiée, deux approches sont admises :

  • Le mot à mot, pour un usage documentaire ou journalistique où chaque mot compte.
  • Le nettoyage léger : on retire les tics de langage et les hésitations sans changer le sens ni l'ordre des idées.

Dans les deux cas, réécoutez le passage avant de publier : un mot mal reconnu peut inverser le sens d'une phrase (« il n'y a pas de risque » et « il y a pas de risque » s'entendent presque pareil, mais un « ne » oublié ou ajouté change la lecture). Pour une citation forte attribuée à un invité, faites-la valider par lui. Si vous hésitez sur le niveau de détail à garder, notre article sur la retranscription intégrale ou ciblée aide à choisir.

Publier la transcription pour l'accessibilité

Une transcription publiée sur la page de l'épisode rend le contenu accessible aux personnes sourdes ou malentendantes, mais aussi à celles qui préfèrent lire, qui écoutent dans une langue qui n'est pas la leur, ou qui veulent retrouver un passage précis.

Quelques règles pour qu'elle soit vraiment utile : intervenants identifiés, paragraphes aérés, indication des éléments sonores qui comptent (rire, extrait musical, archive diffusée), et lien bien visible depuis le lecteur. Pour aller plus loin sur ces conventions, voyez notre guide sur les sous-titres pour sourds et malentendants.

Proposer une version anglaise de l'émission

Beaucoup de podcasts francophones ont un public à l'étranger, ou des invités dont la communauté est anglophone. Deux options réalistes :

  • Une transcription traduite : en mode transcription seule, le menu « Select language » permet d'obtenir le texte en anglais, au même tarif que la transcription. Vous publiez alors des notes d'épisode et une transcription en anglais, l'audio restant en français.
  • Une version audio doublée : en activant « Audio and text output », vous choisissez une langue cible et une voix, puis « Translate audio » produit une piste traduite que vous récupérez avec « Download translated audio ». Une seule voix lit tout l'épisode, ce qui convient à un monologue mais rend une conversation à plusieurs difficile à suivre.
Comparaison de coût

Épisode de 45 minutes : transcription traduite en anglais, 45 crédits. Version doublée : 45 × 50 = 2 250 crédits ($2,25).

Dans les deux cas, faites relire la traduction par un anglophone avant publication. Pour une stratégie plus complète, lisez comment lancer un podcast multilingue (en anglais).

Les erreurs qui reviennent le plus souvent

  • Publier la transcription brute sans relecture : noms d'invités écorchés, marques mal orthographiées, chiffres approximatifs.
  • Transcrire la session non montée, puis passer des heures à supprimer ce qui a été coupé.
  • Oublier de prévenir les invités que l'épisode sera publié aussi en texte, ou traduit.
  • Mélanger anglais et français sans vérifier : les passages en anglais au milieu d'une conversation en français sont transcrits tels qu'entendus, et pas toujours parfaitement.
  • Négliger les noms propres : gardez une liste des noms, lieux et termes de l'épisode pour les vérifier d'un coup avec la fonction rechercher-remplacer.

Questions fréquentes

Combien de temps faut-il pour transcrire un podcast d'une heure ?

La transcription automatique elle-même ne prend que quelques minutes pour un épisode d'une heure. Le vrai temps se passe à la relecture : identifier les intervenants, corriger les noms propres et la ponctuation. Comptez selon la qualité du son et le nombre de voix, mais prévoyez toujours une écoute attentive des passages clés.

Puis-je coller le lien Spotify ou Apple Podcasts de mon épisode ?

Non, mydubly n'importe pas de lien : il faut le fichier audio sur votre ordinateur. Utilisez l'export final de votre logiciel de montage, ou le fichier que vous avez envoyé à votre hébergeur. Pour l'épisode d'un autre podcast, demandez l'autorisation et le fichier à son auteur.

La transcription indique-t-elle qui parle ?

Non. mydubly ne fait pas d'identification des locuteurs : le texte arrive sans noms. Ajoutez-les à la relecture en vous aidant des horodatages, ou transcrivez séparément chaque piste de micro si vous avez enregistré les voix sur des pistes distinctes.

mydubly peut-il rédiger mes notes d'épisode ?

Non, mydubly ne produit pas de résumé. Il vous fournit le texte complet, brut et horodaté. Les notes d'épisode, les chapitres et les citations restent un travail éditorial, beaucoup plus rapide quand on part d'un texte que d'une réécoute complète.

Mon invité est québécois ou belge : la transcription suit-elle ?

La reconnaissance vocale gère les accents francophones, mais sa précision varie selon l'accent, le débit et la qualité du micro. Les expressions régionales et les noms de lieux méritent une vérification particulière. Notre article sur les accents francophones détaille les pièges courants.

Quel format exporter pour transcrire un podcast ?

Un MP3 de bonne qualité ou un WAV conviennent parfaitement. mydubly accepte aussi M4A, AAC, OGG, FLAC et WebM, jusqu'à 2 heures par fichier. Inutile d'exporter en très haute définition : pour la parole, la clarté de l'enregistrement compte bien plus que le format.