Audit gratuit 48 h
Recherche générative11 min de lecture

Gemini et Google : l'articulation entre index classique, Knowledge Graph et réponses générées.

Google ne lit pas votre site comme les autres moteurs génératifs. Avant de chercher des passages, il cherche à savoir de qui l'on parle, dans une base d'entités qu'il construit depuis plus de dix ans. Une marque que cette base connaît mal est mal citée, quelle que soit la qualité de ses pages. Cet article explique comment les trois couches s'articulent et comment rendre votre entreprise lisible pour la couche qui compte le plus.

Sommaire de l'article

Chez Google, la réponse générée s'appuie sur trois couches : l'index, le Knowledge Graph et Gemini

Quand Google produit une réponse rédigée, dans l'application Gemini, dans AI Overviews ou dans AI Mode, trois systèmes interviennent. L'index de la recherche fournit les pages et les passages. Le Knowledge Graph, la base d'entités que Google alimente depuis 2012, fournit les faits établis sur les personnes, les organisations, les lieux et les produits, avec leurs attributs et leurs relations. Gemini, le modèle, reçoit les deux et rédige. D'après la documentation de Google, l'application Gemini s'ancre sur la recherche Google pour vérifier et sourcer ses réponses ; AI Overviews et AI Mode utilisent des versions de Gemini adaptées à la recherche.

Ce qui distingue Google des autres moteurs, c'est la deuxième couche. ChatGPT, Claude et Perplexity reconstruisent une idée de votre entreprise à partir de ce qu'ils lisent, à chaque réponse. Google dispose d'une fiche préexistante, avec un identifiant, un type, des attributs et des sources de confirmation. Quand un utilisateur pose une question qui touche votre marque, Google commence par résoudre l'entité : de quelle organisation s'agit-il, que sait-on d'elle de façon établie, et quelles pages lui sont rattachées. Les passages viennent après.

Schéma 1Le parcours d'une question dans les réponses générées de Google, et la place de la résolution d'entité.
  1. 01Question« Que vaut [marque] pour un audit GEO ? » ou « quelle agence de référencement à Valence ? »
  2. 02Résolution d'entitéLe Knowledge Graph identifie les organisations, lieux et produits nommés ou impliqués, avec leurs attributs établis.
  3. 03RécupérationL'index fournit des passages, en priorité depuis les pages rattachées aux entités résolues.
  4. 04GénérationGemini rédige à partir des faits d'entité et des passages, avec des liens.
  5. 05AffichageRéponse, sources, et parfois un panneau ou une fiche d'établissement à côté.

La part exacte de chaque couche dans une réponse donnée n'est pas publiée. Ce que nous observons, sur nos panels, c'est qu'une marque dont l'entité est bien établie est nommée avec ses bons attributs même quand aucune de ses pages n'est citée, et qu'une marque dont l'entité est confuse est parfois confondue avec une autre, ou décrite avec des attributs périmés, malgré des pages exactes.

Pourquoi l'entité prime sur la page

Une page apporte un passage ; une entité apporte la confiance qui permet de l'utiliser. Trois mécanismes expliquent cette hiérarchie chez Google.

  • La désambiguïsation. Si votre nom est partagé par d'autres organisations, une boutique, une association, une entreprise étrangère, Google doit choisir avant de chercher. Sans entité claire, il choisit parfois mal, et vos pages sont rattachées à la mauvaise fiche ou à aucune.
  • Les attributs établis. Adresse, date de création, dirigeants, secteur, implantations : quand ces faits sont dans le Knowledge Graph, Gemini les énonce sans avoir besoin d'une page. Quand ils n'y sont pas, il les cherche dans des passages, avec un risque d'erreur et de source tierce périmée.
  • Le rattachement des pages. Une page est plus facilement retenue quand Google sait à quelle entité elle appartient et que cette entité est jugée légitime sur le sujet. C'est la version Google de la troisième condition d'une citation, l'identification, décrite dans Comment être cité par ChatGPT, Claude et Perplexity.

Un exemple courant dans nos audits : une agence présente sous trois noms, « SEO360 » sur son site, « SEO 360 Alicante » sur son registre, « Seo360 Agency » dans un annuaire, avec deux adresses différentes. Google en fait deux entités faibles au lieu d'une forte ; Gemini hésite, décrit l'une avec les attributs de l'autre, et AI Overviews cite les pages moins souvent que leur qualité ne le justifie. La correction ne passe pas par les pages, mais par la mise en cohérence de l'entité partout où elle apparaît.

Gemini, AI Overviews, AI Mode : qui utilise quoi

Les trois produits partagent les couches mais ne les exposent pas de la même façon. Le tableau résume ce qui est documenté ou observable, sans préjuger de ce qui ne l'est pas.

CaractéristiqueApplication GeminiAI OverviewsAI Mode
Contexte d'usageAssistant conversationnel, hors de la page de résultatsEncart au-dessus des résultatsOnglet de recherche conversationnel
Ancrage sur la rechercheOptionnel selon la question ; vérification des affirmations proposéeSystématique, sur l'indexSystématique, avec requêtes en éventail
Rôle du Knowledge GraphFaits d'entité dans la réponse, souvent sans citationRésolution d'entité et fiches associéesIdem, avec fiches produits et établissements
Forme des sourcesLiens en fin de réponse, surlignage à la vérificationLiens dans l'encartLiens intégrés et panneau latéral
Contrôle côté siteDonnées structurées, cohérence d'entitéExtraits, données structurées, indexationIdem, plus flux marchands pour les produits

Tableau : faites défiler horizontalement.

La mécanique de sélection des passages dans AI Overviews et AI Mode fait l'objet d'un article dédié, AI Overviews et AI Mode : comment votre site y entre (ou en sort). Ici, nous nous concentrons sur ce que les trois produits ont en commun et que les autres moteurs n'ont pas : la couche d'entités.

Comment Google reconstruit une entité

Google ne publie pas la liste de ses sources d'entités. Ce qui est documenté, ou observable de façon stable, permet néanmoins d'en décrire la logique. Une entité est un nœud avec un nom canonique, un type, des attributs, des relations avec d'autres entités et des sources de confirmation. Elle se construit par recoupement : plus les sources indépendantes s'accordent sur les mêmes faits, plus le nœud est stable et plus Google s'y fie.

Schéma 2Une organisation telle que Google la reconstruit : les six éléments d'une fiche d'entité et leurs sources probables.
Nom canonique
SEO360, avec ses variantes reconnues : SEO 360 Alicante S.L.
Type
Organisation, sous-type agence de marketing ; sans type, la fiche reste une chaîne de caractères.
Attributs
Adresse, date de création, fondateur, secteur, langues, implantations : Alicante, Valence, Madrid, Paris.
Relations
Fondateur (personne), clients ou partenaires cités, secteur d'activité, lieux.
Sources de confirmation
Site officiel et données structurées, registre du commerce, Wikidata, fiche d'établissement, presse, annuaires : la cohérence entre elles fait la solidité de la fiche.
Pages rattachées
Les URL que Google associe à l'entité et qu'il privilégie quand elle est résolue dans une question.

Deux idées reçues méritent d'être écartées. La première : « il suffit d'avoir un panneau de connaissance ». Le panneau est une manifestation visible de l'entité, pas sa condition ; beaucoup d'entreprises ont une entité résolue sans panneau, et la mise en cohérence compte davantage que l'affichage. La seconde : « les données structurées créent l'entité ». Elles la décrivent depuis le site, ce qui aide Google à la rattacher, mais elles ne remplacent pas les sources indépendantes qui la confirment. Nous détaillons ce point dans Knowledge Graph et moteurs génératifs : comment Google « comprend » votre entreprise.

Les quatre surfaces où votre entité doit être identique

La cohérence se travaille sur un petit nombre de surfaces, que Google recoupe entre elles. Nous les traitons dans cet ordre, parce que chacune sert de référence à la suivante.

Schéma 3Les quatre surfaces que Google recoupe pour établir une organisation, et ce qui se passe quand l'une diverge.
  1. 1Le siteDonnées structurées Organization et Person avec un identifiant stable, une page « à propos » factuelle, des pages auteur.Sinon : Google n'a pas de version de référence à comparer aux autres.
  2. 2La fiche d'établissementNom, adresse, catégorie, horaires et site identiques à ceux du site, pour chaque implantation.Sinon : les questions locales tombent sur une entité concurrente ou vide.
  3. 3Les registres et WikidataDénomination légale, identifiants officiels, date de création, siège, reliés au site par un lien réciproque.Sinon : l'entité manque de sources tenues pour neutres.
  4. 4La presse et les annuairesLe même nom, la même description en une phrase, la même spécialité, répétés par des tiers.Sinon : les attributs cités viennent de la source la plus visible, pas de la plus exacte.

Le lien réciproque de la troisième surface est souvent oublié. Une entrée Wikidata qui pointe vers votre site, et un site dont les données structurées pointent vers cette entrée par la propriété sameAs, forment une boucle que Google peut vérifier. Une seule des deux directions laisse un doute. La même logique vaut pour les profils LinkedIn, les registres et les annuaires sectoriels qui acceptent un lien.

Les erreurs qui affaiblissent une entité

Les causes de confusion que nous rencontrons se répètent d'un audit à l'autre. Aucune n'est un problème de contenu ; toutes se corrigent en dehors des pages éditoriales.

  • Un nom partagé avec d'autres organisations, sans élément de désambiguïsation stable, comme une ville, un secteur ou une forme juridique, répété sur toutes les surfaces.
  • Plusieurs graphies du nom (espace, majuscules, suffixe) selon les plateformes, chacune tenue pour une entité possible.
  • Un changement de nom ou de marque sans continuité : ancien site sans redirection, ancienne fiche non fusionnée, registre non mis à jour.
  • Des adresses ou des implantations qui divergent entre le site, la fiche d'établissement et les annuaires.
  • Des données structurées sans type précis ni identifiant, ou copiées d'un gabarit avec les valeurs d'un autre client.
  • Des auteurs sans page dédiée, ou des pages auteur sans lien vers un profil externe vérifiable.
  • Des produits sans identifiants standard, que Google ne peut rattacher ni à une marque ni à une catégorie.

Le cas du changement de marque est le plus coûteux. Google conserve l'ancienne entité tant que des sources la confirment ; si la nouvelle n'est pas reliée à l'ancienne par des redirections, des mises à jour de registre et de fiche, et des mentions de presse qui expliquent le changement, Gemini décrit une entreprise qui n'existe plus, ou deux entreprises au lieu d'une.

Se rendre lisible : le balisage et le plan

Le balisage sert à fournir la version de référence de votre entité depuis votre propre site. Le point technique décisif est l'identifiant : une valeur @id stable, réutilisée sur toutes les pages, qui permet de désigner la même organisation partout, et des identifiants officiels qui la rattachent aux registres.

{
  "@context": "https://schema.org",
  "@type": "Organization",
  "@id": "https://seo360.tech/#organization",
  "name": "SEO360",
  "legalName": "SEO 360 ALICANTE S.L.",
  "vatID": "ES…",
  "foundingDate": "20…",
  "areaServed": ["ES", "FR"],
  "knowsAbout": ["Référencement naturel", "Recherche générative"],
  "sameAs": [
    "https://www.wikidata.org/wiki/Q…",
    "https://www.linkedin.com/company/…"
  ],
  "founder": { "@id": "https://seo360.tech/#kamel-malek" }
}

Le bloc Person du fondateur, publié sur sa page auteur avec le même @id, ferme la relation dans les deux sens. Chaque article porte ensuite un author et un publisher qui renvoient à ces identifiants, au lieu de répéter un nom en texte libre. Google précise que les données structurées ne garantissent aucun affichage ; elles rendent la lecture possible, et c'est la cohérence des autres surfaces qui fait le reste.

Le plan que nous déroulons tient en quatre étapes : fixer le nom canonique et sa phrase de description ; publier le balisage avec identifiants sur le site ; mettre les fiches, registres et Wikidata en conformité avec cette référence, liens réciproques compris ; puis obtenir des mentions tierces qui reprennent les mêmes termes. L'effet se lit en posant à Gemini, sans recherche puis avec recherche, la question « qu'est-ce que [marque] ? », et en comparant les attributs énoncés à la référence.

Schéma 4Une marque à entité consolidée et une marque à entité fragmentée, sur quatre lectures faites dans les produits Google.
Gemini nomme la marque avec ses bons attributs
84 %
37 %
Aucune confusion avec un homonyme
95 %
61 %
AI Overviews cite le site sur ses sujets
42 %
19 %
Questions locales : bonne implantation citée
78 %
33 %
Entité consolidéeEntité fragmentée

Données illustratives. Ce qu'il faut y lire : l'écart le plus large porte sur les attributs et les implantations, qui viennent du Knowledge Graph ; la citation des pages progresse aussi, mais moins, parce qu'elle dépend en plus du contenu.

Cette approche par l'entité est propre à Google, mais elle profite aux autres moteurs. ChatGPT, Claude et Perplexity lisent les mêmes registres, la même Wikidata et la même presse ; une entité mise en cohérence pour Google est aussi une entité plus facile à reconstruire pour eux. La façon dont Claude, en particulier, sélectionne et cite ses sources est décrite dans Claude et la recherche web : comment Anthropic sélectionne et cite ses sources.

Ce qu'il faut retenir

L'essentiel
  • Les réponses générées de Google combinent trois couches : l'index pour les passages, le Knowledge Graph pour les faits d'entité, Gemini pour la rédaction.
  • Google résout l'entité avant de chercher des passages ; une entité confuse est mal nommée, confondue ou décrite avec des attributs périmés, malgré des pages exactes.
  • Une entité se construit par recoupement de sources indépendantes ; le panneau de connaissance en est une manifestation, pas la condition.
  • Quatre surfaces à aligner : le site et son balisage, la fiche d'établissement, les registres et Wikidata, la presse et les annuaires, avec des liens réciproques.
  • Le balisage fournit la référence, avec un identifiant stable et des identifiants officiels ; la cohérence externe fait le reste, et profite aussi aux autres moteurs.

Questions fréquentes

Qu'est-ce que le Knowledge Graph de Google ?

C'est la base d'entités que Google alimente depuis 2012 : des personnes, des organisations, des lieux et des produits, chacun avec un nom canonique, un type, des attributs, des relations avec d'autres entités et des sources de confirmation. Les réponses générées de Google s'en servent pour identifier de qui l'on parle et énoncer des faits établis, avant de chercher des passages dans l'index. Google ne publie pas la liste complète de ses sources.

Faut-il un panneau de connaissance pour être bien traité par Gemini ?

Non. Le panneau est une manifestation visible d'une entité résolue, pas sa condition. Beaucoup d'entreprises sont correctement identifiées sans panneau, et ce qui compte est la cohérence entre le site, la fiche d'établissement, les registres, Wikidata et les mentions tierces. Un panneau peut d'ailleurs afficher des attributs erronés si ces sources divergent ; la mise en cohérence prime sur l'affichage.

Les données structurées suffisent-elles à créer l'entité de mon entreprise ?

Non. Elles fournissent la version de référence depuis votre site, avec un identifiant stable et des identifiants officiels, ce qui aide Google à rattacher vos pages à la bonne organisation. Mais une entité se consolide par recoupement de sources indépendantes : registre du commerce, Wikidata, fiche d'établissement, presse, annuaires. Google précise en outre que le balisage ne garantit aucun affichage particulier.

Pourquoi Gemini confond-il mon entreprise avec une autre ?

Le plus souvent parce que le nom est partagé et qu'aucun élément de désambiguïsation stable, ville, secteur, forme juridique, n'est répété sur toutes les surfaces, ou parce que plusieurs graphies du nom coexistent et sont tenues pour des entités distinctes. Un changement de marque sans redirections ni mise à jour des registres et des fiches produit le même effet. La correction se fait sur les surfaces externes, pas dans les pages éditoriales.

Le travail sur l'entité pour Google sert-il aussi pour ChatGPT, Claude et Perplexity ?

Oui. Ces moteurs n'ont pas de base d'entités comparable au Knowledge Graph, mais ils lisent les mêmes registres, la même Wikidata, la même presse et les mêmes annuaires pour reconstruire une idée de votre entreprise à chaque réponse. Une entité mise en cohérence pour Google, avec un nom canonique, une description stable et des liens réciproques, est donc aussi plus facile à identifier et à citer pour les autres moteurs.

Portrait de Kamel Malek
Kamel Malek
Fondateur & directeur de l'agence

Praticien du référencement depuis 2001, Kamel Malek dirige SEO360 (Alicante, Valence, Madrid, Paris). Il a publié trois ouvrages sur la visibilité dans les moteurs génératifs, dont Generative Engine Optimization et Rétablir les faits.