Audit gratuit 48 h
Autorité11 min de lecture

YouTube, podcasts et transcriptions : des sources que les moteurs génératifs lisent.

Une vidéo d'une heure où votre expert explique une méthode n'existe pas, pour un moteur génératif, tant que son contenu n'est pas écrit quelque part : titre, description, chapitres, transcription. Les moteurs lisent du texte ; ils ne regardent pas et n'écoutent pas, ou pas de façon documentée. Voici comment rendre une vidéo ou un épisode de podcast accessible, citable et attribué à une personne identifiée, et où placer la transcription pour qu'elle serve.

Sommaire de l'article

Un moteur génératif ne regarde pas une vidéo : il lit le texte qui l'entoure

Ce qu'un moteur génératif récupère d'une vidéo ou d'un épisode de podcast, c'est le texte qui l'accompagne : le titre, la description, la liste des chapitres, les sous-titres ou la transcription lorsqu'ils sont exposés dans la page, parfois les commentaires. Le fichier audio ou vidéo lui-même n'est pas lu par les robots de recherche IA, à notre connaissance : aucun éditeur de moteur ne documente une écoute ou un visionnage au moment de la sélection des sources. Une heure d'expertise sans texte est donc, pour la citation, une page vide surmontée d'un titre.

Google fait en partie exception : son index vidéo exploite les sous-titres et les « moments clés », et il documente la façon de les déclarer. Mais cela vaut pour la recherche Google, AI Overviews et AI Mode compris ; ChatGPT, Perplexity et Claude s'appuient sur ce que la page HTML donne à lire. Les quatre conditions d'une citation, décrites dans notre article de méthode, s'appliquent donc à l'audiovisuel comme au reste, avec une traduction propre à ces formats.

Schéma 1Les quatre conditions d'une citation, traduites pour une vidéo ou un épisode de podcast.
  1. 1AccessibleLa transcription et la description sont dans le HTML de la page, lisibles par les robots de recherche IA.Sinon : la vidéo n'existe pas pour le moteur.
  2. 2CitableLes chapitres sont des questions ; chaque passage de la transcription répond seul.Sinon : rien n'est extrait d'un monologue d'une heure.
  3. 3IdentifiéeL'intervenant est nommé, décrit, relié à sa page auteur et à son entité.Sinon : la parole est anonyme, donc faible.
  4. 4CorroboréeL'intervenant dit la même chose que le site et que les autres sources, dans les mêmes termes.Sinon : un témoignage isolé.

Le reste de l'article suit ces quatre conditions : où placer la transcription pour qu'elle soit accessible, comment décrire et chapitrer pour qu'elle soit citable, comment identifier l'intervenant, et comment les invitations chez d'autres servent la corroboration.

Ce qui est lisible dans une page vidéo ou podcast : anatomie

Une page vidéo ou podcast bien construite donne au moteur cinq éléments, dans cet ordre d'importance : un titre formulé comme la question traitée, une description qui répond en quelques phrases, des chapitres qui découpent l'épisode en questions, une transcription relue, et l'identité de l'intervenant. Les plateformes n'exposent pas tous ces éléments de la même façon ; la page de votre propre site peut les exposer tous.

Schéma 2Anatomie d'une page d'épisode lisible par un moteur génératif : les cinq éléments de texte qui entourent le lecteur.
Titre-question
Comment savoir si votre site bloque les robots de recherche IA ? (32 min)
Description
Dans cet épisode, Prénom Nom, responsable technique chez SEO360, explique comment lire un fichier robots.txt, les règles d'un CDN et les journaux serveur pour vérifier l'accès de OAI-SearchBot, Claude-SearchBot et PerplexityBot.
Chapitres
0:00 Pourquoi l'accès passe avant le contenu · 4:10 Lire le robots.txt · 11:35 Les règles du CDN · 19:20 Chercher les agents dans les journaux · 27:05 Que faire en cas de blocage
Transcription
Texte intégral relu, noms propres corrigés, découpé en paragraphes sous des intertitres qui reprennent les chapitres.
Intervenant
Lien vers la page auteur, fonction, entreprise ; balisage Person avec sameAs.

La description est le passage le plus souvent extrait, parce qu'elle est courte, qu'elle commence par le sujet et qu'elle nomme l'intervenant. Elle se rédige comme un passage citable : la réponse, la preuve, la nuance, en soixante à cent mots, avant les liens et les mentions promotionnelles. Une description réduite à « Nouvel épisode ! Abonnez-vous » n'apprend rien au moteur.

Où placer la transcription : la plateforme, votre site, ou les deux

Sur votre site d'abord, puis sur la plateforme si elle le permet. Les plateformes génèrent des sous-titres ou des transcriptions, mais elles ne les exposent pas toujours dans le HTML que lisent les robots de recherche IA, et vous n'en contrôlez ni l'exactitude ni la persistance. Une page de votre site, avec la transcription intégrale, la description et les chapitres, est le seul support dont vous maîtrisez l'accès, le texte et les données structurées.

SupportCe que le robot litCe que vous contrôlezRecommandation
YouTubeTitre, description, chapitres, commentaires ; les sous-titres sont accessibles au lecteur, pas exposés de façon fiable dans le HTMLTitre, description, chapitres, sous-titres importésSoigner la description et les chapitres ; importer des sous-titres relus
Flux RSS du podcastTitre et description de l'épisode ; une transcription si le flux la déclare (balise podcast:transcript)Tout, via l'hébergeurDéclarer la transcription dans le flux quand l'hébergeur le permet
Applications d'écouteMétadonnées du flux ; transcriptions générées ou fournies, affichées dans l'applicationMétadonnées ; transcription fournie, selon la plateformeUtile pour l'auditeur ; ne pas compter dessus pour la citation
Page de votre siteTout : titre, description, chapitres, transcription intégrale, intervenant, données structuréesToutLe support de référence : une page par épisode
PDF ou image de la transcriptionPeu ou rienToutÀ éviter : le texte doit être dans le HTML

Tableau : faites défiler horizontalement.

La balise podcast:transcript appartient à l'espace de noms « Podcasting 2.0 », pris en charge par une partie des hébergeurs et des applications ; elle accepte plusieurs formats, dont SRT, VTT et HTML. Elle est utile, mais elle ne remplace pas la page HTML : c'est cette page, et non le flux, que les robots de recherche IA récupèrent le plus sûrement. Le principe est le même que pour le rendu JavaScript : ce qui n'est pas dans le HTML servi n'existe pas, et une page d'épisode dont la transcription se charge par script est une page vide.

Décrire, chapitrer, baliser : les règles documentées

Trois règles suffisent pour la description, les chapitres et le balisage, et les deux dernières sont documentées par les plateformes elles-mêmes. Pour les chapitres YouTube, la liste d'horodatages se place dans la description, commence à 0:00, compte au moins trois entrées dans l'ordre croissant, chacune d'au moins dix secondes ; chaque titre de chapitre est une question ou une affirmation précise, jamais « Partie 2 ». Pour Google, le balisage VideoObject décrit la vidéo, et la propriété hasPart, avec des objets Clip, déclare les moments clés, chacun avec son début, sa fin et son URL horodatée.

{
  "@context": "https://schema.org",
  "@type": "VideoObject",
  "name": "Comment savoir si votre site bloque les robots de recherche IA ?",
  "description": "La description de l'épisode, en soixante à cent mots, réponse d'abord.",
  "uploadDate": "2026-07-15",
  "duration": "PT32M10S",
  "thumbnailUrl": "https://www.exemple.fr/img/episode-12.jpg",
  "embedUrl": "https://www.youtube.com/embed/IDENTIFIANT",
  "transcript": "Transcription intégrale relue…",
  "author": { "@type": "Person", "name": "Prénom Nom", "url": "https://www.exemple.fr/equipe/prenom-nom" },
  "publisher": { "@type": "Organization", "@id": "https://www.exemple.fr/#organization" },
  "hasPart": [
    { "@type": "Clip", "name": "Lire le robots.txt",
      "startOffset": 250, "endOffset": 695,
      "url": "https://www.exemple.fr/podcast/episode-12?t=250" }
  ]
}

La propriété transcript de VideoObject existe dans le vocabulaire schema.org ; à notre connaissance, aucun moteur ne documente son usage dans la sélection des sources. Elle ne dispense donc pas de publier la transcription en clair dans la page. Pour un podcast, les types PodcastEpisode et PodcastSeries décrivent l'épisode et la série de la même façon ; l'essentiel reste le texte visible.

La transcription elle-même se relit avant publication. Les transcriptions automatiques écorchent les noms propres, les sigles et les noms de marque ; une transcription où votre entreprise apparaît trois fois sous trois graphies produit trois mentions incohérentes. On corrige les noms, on découpe en paragraphes sous des intertitres qui reprennent les chapitres, et l'on supprime les hésitations sans réécrire le propos : une transcription réécrite en texte marketing perd ce qui faisait sa valeur, la parole d'un expert qui répond à une question.

L'entité de l'intervenant : qui parle, et pourquoi cela compte

Une vidéo est citée comme la parole d'une personne, et la personne doit être identifiable : nom, fonction, entreprise, page auteur sur votre site, profils reliés par sameAs. Sans cela, le moteur dispose d'une transcription anonyme, moins fiable qu'une page signée ; avec cela, il dispose d'un expert nommé, dont il peut relier les propos à l'entité de votre marque et à ses autres publications. C'est la troisième condition, l'identification, et elle vaut pour la voix comme pour l'écrit.

  • Nommer l'intervenant dans la description, avec sa fonction et son entreprise, dès la première phrase.
  • Relier la page de l'épisode à sa page auteur sur le site, et inversement : la page auteur liste les épisodes, avec leurs dates.
  • Baliser en Person, avec sameAs vers la chaîne YouTube, le profil LinkedIn et, s'il existe, l'élément Wikidata.
  • Utiliser le même nom partout : chaîne, flux, description, page auteur, signature d'article.

Ce que doit contenir une page auteur, et comment prouver une expertise à un modèle, est détaillé dans notre article sur les pages auteur. Pour l'audiovisuel, ajoutez-y une chose : la liste des interventions chez d'autres, qui est la matière de la corroboration.

Être invité chez les autres : la corroboration par la voix

Une intervention dans le podcast ou la chaîne d'un tiers est une mention de marque portée par une source indépendante, avec un nom, une catégorie et, si vous l'avez préparée, une preuve. C'est l'un des moyens les plus naturels d'obtenir une corroboration : l'hôte vous présente, dans ses notes d'épisode et dans sa description, avec des mots qu'il a choisis à partir de ceux que vous lui avez donnés.

Schéma 3Une invitation chez un tiers, de la sélection des émissions citées au lien depuis votre site.
  1. 01Choisir les émissions citéesRelever, sur le panel de questions, les podcasts et chaînes qui apparaissent dans les sources. Pas les plus écoutés : les cités.
  2. 02Préparer la présentationLa formulation de référence, en une phrase, et deux ou trois faits datés que vous voulez entendre reprendre.
  3. 03Fournir les notes d'épisodeUne description prête, des chapitres proposés, votre nom et votre fonction exacts. L'hôte les reprend souvent tels quels.
  4. 04Demander la transcriptionSi l'hôte en publie une, vérifier les noms propres ; sinon, proposer la vôtre.
  5. 05Relier depuis votre sitePage auteur et page presse : titre de l'épisode, date, lien, phrase de présentation.

Le point décisif est la troisième étape. La plupart des hôtes rédigent leurs notes d'épisode à la hâte ; celui qui reçoit une description prête, correcte et courte l'utilise. C'est cette description, publiée sur le site de l'hôte, qui devient la mention cohérente : votre nom exact, votre catégorie, un fait, dans une source indépendante que le moteur peut rapprocher de votre site. Le même raisonnement vaut pour les comparatifs et annuaires : ce que le tiers écrit de vous dépend de ce que vous lui avez donné à écrire.

Ce que change une transcription relue : lecture d'un relevé

La différence entre une page vidéo réduite à un titre et une page avec description, chapitres et transcription relue se lit directement dans les sources des réponses. Le schéma ci-dessous illustre ce que l'on observe sur nos mandats, à titre indicatif, pour une même série d'épisodes avant et après la publication des pages texte.

Schéma 4Part des questions du panel pour lesquelles un épisode de la série est cité, avant et après publication des pages texte, par moteur.
ChatGPT
4 %
31 %
Perplexity
6 %
38 %
Google AI Overviews
9 %
27 %
Claude
3 %
22 %
Titre et lecteur seulsDescription, chapitres, transcription

Données illustratives. Ce qu'il faut y lire : sans texte, un épisode n'est presque jamais une source ; avec, il concurrence les articles écrits. L'écart tient à la transcription, pas au contenu audio, qui est le même.

Les erreurs qui annulent cet effet sont peu nombreuses et faciles à vérifier.

  • Une transcription automatique publiée sans relecture, avec les noms de marque et les sigles écorchés.
  • Une page d'épisode dont le texte est chargé par script, absent du HTML initial.
  • Une description réduite à un appel à l'abonnement, sans sujet ni intervenant.
  • Des chapitres qui ne commencent pas à 0:00, ou nommés « Partie 1, 2, 3 ».
  • Un intervenant désigné comme « notre expert », sans nom ni page auteur.
  • Une transcription livrée en PDF ou en image.
  • Une page d'épisode que le CDN ferme aux robots de recherche IA, comme le reste du site.

Ce qu'il faut retenir

L'essentiel
  • Un moteur génératif ne lit ni l'audio ni la vidéo : il lit le titre, la description, les chapitres et la transcription exposés dans le HTML.
  • La page de référence est celle de votre site : une page par épisode, avec transcription intégrale relue, chapitres en questions et intervenant nommé.
  • La description se rédige comme un passage citable ; les chapitres YouTube suivent les règles documentées (0:00, trois entrées, dix secondes minimum).
  • L'intervenant est une entité : page auteur, balisage Person, sameAs, même nom partout.
  • Être invité chez d'autres produit des mentions cohérentes, à condition de fournir à l'hôte les notes d'épisode qu'il publiera.

Questions fréquentes

Les sous-titres automatiques de YouTube suffisent-ils pour être cité ?

Non. Ils sont accessibles dans le lecteur, mais ils ne sont pas exposés de façon fiable dans le HTML que lisent les robots de recherche IA, et ils écorchent les noms propres. Importez des sous-titres relus si vous voulez qu'ils servent sur YouTube, et publiez la transcription intégrale sur une page de votre site : c'est cette page, avec sa description et ses chapitres, qui devient la source.

Faut-il publier la transcription intégrale ou un résumé ?

Les deux, dans cet ordre sur la page : un résumé de soixante à cent mots qui répond à la question de l'épisode, puis la transcription intégrale, découpée en sections dont les intertitres reprennent les chapitres. Le résumé est le passage le plus souvent extrait ; la transcription apporte les faits et les nuances, et permet au moteur de vérifier que le résumé n'invente rien.

Un podcast sans site propre peut-il être cité par les moteurs génératifs ?

Rarement, et sans contrôle de votre part. Les pages d'hébergeur exposent au mieux le titre et la description ; les applications d'écoute ne sont pas des pages lisibles par les robots de recherche IA. Une page par épisode sur votre site, même simple, avec description, chapitres et transcription, change la situation. Si vous n'avez pas de site, une page d'hébergeur bien remplie est un pis-aller.

Les commentaires sous une vidéo sont-ils lus par les moteurs ?

Ils font partie du texte de la page et peuvent être récupérés, mais leur poids dans la sélection des sources n'est pas documenté. Ils comptent surtout comme corroboration légère : des commentaires qui confirment un point de l'épisode, ou qui nomment votre marque avec sa catégorie, s'ajoutent aux autres mentions. Ne les sollicitez pas artificiellement ; répondez-y sous votre nom, avec des faits.

Quelle longueur pour la description d'un épisode ?

Soixante à cent mots pour la partie qui compte : la question traitée, la réponse en une ou deux phrases, le nom et la fonction de l'intervenant. Les liens, les remerciements et les appels à l'abonnement viennent ensuite, après les chapitres. Une description plus longue n'est pas un problème si la réponse est au début ; une description où la réponse arrive après trois paragraphes de promotion n'est pas extraite.

Portrait de Kamel Malek
Kamel Malek
Fondateur & directeur de l'agence

Praticien du référencement depuis 2001, Kamel Malek dirige SEO360 (Alicante, Valence, Madrid, Paris). Il a publié trois ouvrages sur la visibilité dans les moteurs génératifs, dont Generative Engine Optimization et Rétablir les faits.