Audit gratuit 48 h
Données structurées12 min de lecture

Construire l'entité de votre marque : sameAs, Wikidata, registres et cohérence.

Un moteur génératif ne connaît pas votre marque : il la reconstruit, à chaque question, à partir de tout ce qu'il trouve sous son nom. Si le site, LinkedIn, les registres, les annuaires et Wikidata racontent quatre versions différentes, il obtient quatre entités faibles au lieu d'une seule entité forte. Voici la méthode pour réconcilier ces présences : une fiche d'identité canonique, des liens sameAs choisis, un identifiant Wikidata, et un ordre de correction qui commence par ce que vous contrôlez.

Sommaire de l'article

Une entité forte est une entité que le moteur reconstruit sans effort

Pour un modèle de langage, votre marque n'est pas une fiche stockée quelque part : c'est un nœud qu'il reconstitue à chaque question, en rapprochant toutes les mentions qui portent le même nom et les mêmes attributs. Quand ces mentions concordent, le rapprochement est immédiat et le nœud est solide ; le moteur sait qui vous êtes, ce que vous faites et où, et il peut vous citer avec confiance. Quand elles divergent, il hésite entre plusieurs candidats, ou il en fabrique plusieurs, chacun trop faible pour être retenu comme source.

C'est la condition « identifiée » de notre méthode complète, vue du côté de la marque plutôt que de la page. Les données structurées décrivent l'entité sur votre site ; l'entité elle-même se construit partout ailleurs, dans la concordance entre ce que vous déclarez et ce que les tiers disent de vous. Les deux sujets se complètent : l'article sur schema.org traite du balisage, celui-ci traite de la cohérence.

Ce mécanisme de rapprochement est bien décrit pour les graphes de connaissance classiques, et rien n'indique que les moteurs génératifs procèdent autrement, même si aucun éditeur n'en a publié le détail. Dans nos audits, le cas le plus fréquent n'est pas l'absence d'information mais sa fragmentation : trois graphies du nom, deux adresses, une description différente sur chaque plateforme, et un fondateur rattaché à une ancienne raison sociale.

Schéma 1Comment un moteur rapproche les mentions d'une marque pour en faire une entité, et l'étape où la fragmentation lui fait perdre confiance.
  1. 01MentionUn nom apparaît dans une page : le site, un profil, un registre, un article de presse.
  2. 02ExtractionLe moteur relève les attributs qui accompagnent le nom : ville, métier, dirigeant, domaine, identifiant.
  3. 03CandidatsIl cherche les entités déjà connues qui portent un nom proche, parfois plusieurs.
  4. 04RapprochementChaque attribut concordant renforce la fusion en un seul nœud ; chaque divergence la bloque ou crée un doublon.
  5. 05Entité citéeLe nœud unique, riche en attributs cohérents, devient une source que le moteur peut nommer sans risque.

Le point décisif est l'étape de rapprochement. Le moteur cherche des attributs communs entre les mentions : le nom exact, le domaine du site, la ville, le fondateur, un identifiant. Chaque attribut concordant renforce le rapprochement ; chaque divergence l'affaiblit. Votre travail consiste à multiplier les concordances et à supprimer les divergences, dans cet ordre de priorité.

Fixer la fiche d'identité canonique avant de toucher à quoi que ce soit

La première décision n'est pas technique : c'est le choix, une fois pour toutes, de la version de référence de chaque attribut. Tant que cette fiche n'existe pas, chaque personne qui crée un profil, remplit un annuaire ou répond à un journaliste improvise, et l'entité se fragmente à nouveau. La fiche tient sur une page et se partage avec tous ceux qui parlent de l'entreprise à l'extérieur : direction, marketing, commerciaux, agence de relations presse.

Schéma 2La fiche d'identité canonique d'une marque : sept attributs fixés une fois, repris à la lettre sur chaque présence.
Nom commercial
SEO360 — jamais « SEO 360 », « Seo360 » ni « SEO360 Agency »
Raison sociale
SEO 360 ALICANTE S.L., telle qu'inscrite au registre du commerce
Description
Agence de référencement et de recherche générative, présente à Alicante, Valence, Madrid et Paris.
Siège
Elche, province d'Alicante, Espagne
Dirigeant
Kamel Malek, fondateur et directeur, écrit ainsi sur sa page auteur et ses profils
Identifiants
NIF, numéro de TVA intracommunautaire, identifiant Wikidata, profil LinkedIn officiel
Contact
hola@seo360.tech, domaine seo360.tech, un seul numéro de téléphone principal

Trois attributs demandent une attention particulière. Le nom commercial doit être choisi avec sa casse et ses espaces, puis écrit ainsi partout, y compris dans les signatures de courriel et les communiqués. La description en une phrase doit dire le métier et le territoire avec des mots courants : c'est la phrase que les tiers copieront, donc celle que le moteur retrouvera. Le dirigeant doit être nommé de la même façon que sur sa page auteur et ses profils, parce que la personne est l'un des attributs les plus discriminants pour rapprocher deux mentions.

IdentifiantÉmetteurCe qu'il apporte au rapprochement
SIREN, SIRETINSEE (France)Unicité de l'entreprise et de l'établissement, raison sociale officielle
NIFAdministration fiscale (Espagne)Identité fiscale de la société, reprise dans le registre du commerce
Numéro de TVA intracommunautaireSystème VIES (Union européenne)Vérifiable en ligne par n'importe quel tiers
LEIFondation GLEIFIdentifiant mondial, base ouverte, reconnu par schema.org (leiCode)
DUNSDun & BradstreetUtilisé par les annuaires professionnels et les plateformes d'achat
Identifiant OpenCorporatesOpenCorporatesPont entre les registres nationaux et les bases ouvertes
Identifiant QWikidataPivot des graphes de connaissance, indépendant du site

Tableau : faites défiler horizontalement.

Les identifiants administratifs ne sont pas des détails. Un numéro SIREN, un NIF ou un LEI est unique par construction ; quand il apparaît à la fois sur votre site, dans un registre public et sur une base ouverte, il permet un rapprochement sans ambiguïté, là où un nom peut être porté par plusieurs sociétés.

Trois cercles de présences, trois niveaux de contrôle

Les présences d'une marque se classent selon ce que vous pouvez en faire. Le premier cercle est sous votre contrôle direct : le site, les profils sociaux officiels, les fiches d'établissement que vous administrez. Le deuxième est déclaratif : registres, bases ouvertes, annuaires où l'information vient de vous mais passe par un tiers, avec ses délais et ses procédures. Le troisième est indépendant : presse, Wikipédia, comparatifs, avis, où vous ne pouvez que demander une correction et la justifier.

Schéma 3Les trois cercles de présences d'une marque, du plus contrôlé au plus indépendant ; la valeur de corroboration croît en sens inverse du contrôle.
  1. 1Présences contrôléesSite, profils sociaux officiels, fiches d'établissement Google, Apple et Bing, pages carrières.Sinon : le moteur n'a même pas de version de référence.
  2. 2Présences déclarativesRegistres du commerce, VIES, GLEIF, OpenCorporates, annuaires professionnels, Wikidata.Sinon : aucun tiers institutionnel ne confirme vos attributs.
  3. 3Présences indépendantesPresse, Wikipédia, comparatifs, plateformes d'avis, interventions publiques.Sinon : l'entité reste déclarée, jamais corroborée.

L'ordre de traitement suit les cercles. Corriger le premier cercle prend une semaine et ne dépend de personne ; c'est aussi le plus lu, parce que les moteurs partent du site et des profils qu'il déclare. Le deuxième cercle demande des procédures, parfois payantes, mais produit des concordances de grande valeur parce qu'elles viennent d'un tiers institutionnel. Le troisième cercle se travaille en continu, et c'est lui qui fait la différence entre une entité déclarée et une entité corroborée.

sameAs : relier des preuves, pas accumuler des liens

La propriété sameAs dit au moteur : « cette page externe décrit la même entité que ce site ». Elle ne crée pas de notoriété ; elle sert de pont pour le rapprochement. Un pont n'a de valeur que si les deux rives concordent : la page visée doit porter le même nom, la même description et, idéalement, un lien retour vers le site. Dans le cas contraire, vous demandez au moteur de fusionner deux entités qui ne se ressemblent pas, et il refusera ou, pire, il mélangera.

Le choix des liens obéit à trois critères : la page existe et vous représente officiellement ; elle est tenue à jour ; elle apporte un attribut que les autres n'ont pas. Le registre apporte la raison sociale, LinkedIn apporte l'effectif et les personnes, Wikidata apporte un identifiant universel, une fiche d'établissement apporte l'adresse et les horaires. Cinq à huit liens suffisent presque toujours. Les profils créés « pour le référencement » et jamais alimentés doivent être retirés de la liste, puis fermés.

{
  "@context": "https://schema.org",
  "@type": "Organization",
  "@id": "https://www.vidal-traiteur.example/#organization",
  "name": "Maison Vidal Traiteur",
  "legalName": "VIDAL TRAITEUR SAS",
  "url": "https://www.vidal-traiteur.example",
  "description": "Traiteur pour entreprises et réceptions à Toulouse et en Haute-Garonne depuis 1998.",
  "foundingDate": "1998",
  "founder": { "@type": "Person", "name": "Claire Vidal" },
  "address": {
    "@type": "PostalAddress",
    "streetAddress": "12 rue des Cuisines",
    "postalCode": "31000",
    "addressLocality": "Toulouse",
    "addressCountry": "FR"
  },
  "identifier": [
    { "@type": "PropertyValue", "propertyID": "SIREN", "value": "…" },
    { "@type": "PropertyValue", "propertyID": "Wikidata", "value": "Q…" }
  ],
  "iso6523Code": "0002:…",
  "vatID": "FR…",
  "sameAs": [
    "https://www.wikidata.org/wiki/Q…",
    "https://www.linkedin.com/company/…",
    "https://annuaire-entreprises.data.gouv.fr/entreprise/…",
    "https://opencorporates.com/companies/fr/…"
  ]
}

La propriété identifier, avec des objets PropertyValue, déclare les numéros de registre sous une forme lisible ; iso6523Code, documentée par Google, fait la même chose avec le préfixe normalisé de chaque système, par exemple 0002 pour le répertoire SIRENE et 0199 pour le LEI. Ces déclarations ne remplacent pas l'inscription au registre : elles la rendent trouvable depuis le site, ce qui est exactement le pont dont le moteur a besoin.

Wikidata : l'identifiant que tous les graphes partagent

Wikidata est une base de connaissances libre, lisible par les machines, où chaque entité reçoit un identifiant unique de la forme Q suivie d'un nombre. Cet identifiant est utilisé bien au-delà des projets Wikimédia : les graphes de connaissance et les outils de traitement du langage s'en servent comme pivot pour rapprocher des mentions. Une entreprise qui y figure avec ses attributs de base fournit aux moteurs un point d'ancrage stable, indépendant de son site et de ses profils.

Il faut respecter les règles du projet. Une entrée est admissible si elle correspond à une entité clairement identifiable, décrite par des références sérieuses et publiquement accessibles, ou si elle possède déjà un article dans un projet Wikimédia. Une petite entreprise sans aucune couverture indépendante ne remplit pas ce critère, et une entrée créée malgré tout sera supprimée. Les règles d'admissibilité et les pratiques à proscrire sont détaillées dans l'article consacré à Wikipédia et Wikidata.

Propriété WikidataContenuRéférence à fournir
P31 nature de l'élémentEntreprise, ou une forme juridique plus préciseRegistre du commerce
P17 paysPays du siègeRegistre du commerce
P159 siège socialVille du siègeRegistre du commerce ou site officiel
P571 date de fondationAnnée, ou date complète si connueRegistre du commerce
P112 fondé parÉlément Wikidata du fondateur, s'il existeSite officiel, publication indépendante
P856 site web officielAdresse canonique du siteAucune, la valeur est vérifiable
P2002, P4264Identifiants X et LinkedIn de l'organisationAucune, la valeur est vérifiable
P1320, P1278Identifiants OpenCorporates et LEIBase OpenCorporates, base GLEIF

Tableau : faites défiler horizontalement.

Chaque déclaration doit porter une référence : le registre pour la forme juridique et la date de création, le site officiel pour l'adresse et le dirigeant, une publication indépendante pour tout ce qui relève de la notoriété. Une fois l'entrée créée, l'identifiant Q est ajouté dans sameAs et, réciproquement, le site officiel est déclaré dans Wikidata : c'est ce double lien que les graphes vérifient. Ne décrivez jamais l'entreprise en termes promotionnels dans Wikidata ; la description se limite à la nature et au lieu, par exemple « entreprise de traiteur française ».

Mesurer la cohérence, puis corriger dans l'ordre

La cohérence d'une entité se mesure simplement : pour chaque présence connue, on relève le nom, la description, l'adresse et le dirigeant, et on note si chaque attribut correspond à la fiche canonique. Le tableau qui en résulte montre où se trouve la fragmentation et par où commencer. Dans nos audits, le premier cercle est rarement le problème ; ce sont les annuaires, les anciens communiqués et les fiches créées par des tiers qui portent les variantes.

Schéma 4Part des présences conformes à la fiche canonique, par cercle, avant et après six mois d'harmonisation.
Site et profils officiels
70 %
100 %
Fiches d'établissement
55 %
95 %
Registres et bases ouvertes
60 %
100 %
Annuaires sectoriels
35 %
80 %
Presse et mentions
40 %
60 %
Avant harmonisationAprès six mois

Données illustratives. Ce qu'il faut y lire : les cercles contrôlé et déclaratif se corrigent entièrement ; les présences indépendantes ne bougent que partiellement, et seulement une fois les deux premiers cercles alignés.

La correction suit une règle : ne jamais demander à un tiers de corriger ce que votre propre site ne dit pas encore correctement. Un journaliste ou un contributeur de base ouverte vérifiera sur le site avant de modifier ; si le site est ambigu, la demande échoue. D'où l'ordre : premier cercle, puis registres et bases, puis présences indépendantes, en commençant par celles que les moteurs citent le plus souvent pour votre secteur.

  • Plusieurs graphies du nom commercial, avec ou sans espace, avec ou sans suffixe « Agency », « Group » ou « France ».
  • Une ancienne raison sociale qui survit dans les annuaires et les profils après un changement de forme juridique.
  • Une adresse de siège dans les registres et une adresse de bureau sur le site, sans que le lien entre les deux soit expliqué.
  • Deux fiches d'établissement pour le même lieu, l'une revendiquée, l'autre créée automatiquement.
  • Une description différente sur chaque réseau social, rédigée par des personnes différentes à des époques différentes.
  • Un dirigeant dont le profil LinkedIn mentionne une autre société comme employeur actuel.
  • Des profils fantômes déclarés dans sameAs, jamais alimentés, parfois au nom d'un ancien prestataire.

Enfin, la cohérence se maintient. Un déménagement, un changement de forme juridique, une nouvelle marque produit ou l'arrivée d'un dirigeant se propagent dans le même ordre, avec la fiche canonique mise à jour avant toute communication. Le panneau de connaissance de Google est un bon indicateur de cette cohérence : quand il affiche vos attributs sans erreur, c'est que le rapprochement s'est fait.

Ce qu'il faut retenir

L'essentiel
  • Un moteur reconstruit votre marque en rapprochant ses mentions ; chaque attribut concordant renforce l'entité, chaque divergence la fragmente.
  • Tout commence par une fiche d'identité canonique : nom, raison sociale, description en une phrase, siège, dirigeant, identifiants, contact.
  • Les présences se traitent par cercles : contrôlées d'abord, déclaratives ensuite, indépendantes en continu.
  • sameAs relie cinq à huit pages qui existent, vous représentent et apportent chacune un attribut ; les identifiants administratifs se déclarent avec identifier et iso6523Code.
  • Wikidata fournit un identifiant pivot, à condition d'être admissible et de rester factuel ; le double lien site-Wikidata est ce que les graphes vérifient.

Questions fréquentes

Combien de liens sameAs faut-il déclarer ?

Cinq à huit, choisis pour leur valeur de preuve : le registre ou une base ouverte pour la raison sociale, LinkedIn pour les personnes et l'effectif, Wikidata pour l'identifiant pivot, la fiche d'établissement pour l'adresse, puis un ou deux profils réellement animés. Un lien vers un profil vide ou vers une page qui ne vous nomme pas affaiblit la fiche au lieu de la renforcer.

Toute entreprise peut-elle créer son entrée Wikidata ?

Non. Wikidata exige que l'entité soit clairement identifiable et décrite par des références sérieuses et publiquement accessibles, ou qu'elle possède déjà un article dans un projet Wikimédia. Une entreprise sans couverture indépendante n'est pas admissible, et une entrée créée malgré tout sera supprimée. Commencez par obtenir des mentions de presse ou des inscriptions dans des bases reconnues.

Que faire si le nom de la marque est aussi porté par d'autres sociétés ?

Multipliez les attributs discriminants sur chaque présence : ville, métier, dirigeant, année de création, domaine du site et identifiants administratifs. Ce sont ces attributs, plus que le nom, qui permettent au moteur de rapprocher les mentions qui vous concernent et d'écarter les autres. Une description en une phrase qui contient le métier et le territoire suffit souvent à lever l'ambiguïté.

Par où commencer quand tout est incohérent ?

Par la fiche canonique, puis par ce que vous contrôlez : site, profils officiels, fiches d'établissement. Ensuite seulement les registres et bases ouvertes, puis les présences indépendantes. Un tiers vérifie sur votre site avant de corriger sa propre page ; tant que le site est ambigu, les demandes de correction échouent.

Faut-il déclarer le numéro SIREN ou le NIF sur le site ?

Oui, et il figure souvent déjà dans les mentions légales. Le déclarer aussi dans le balisage Organization, avec identifier, vatID ou iso6523Code, rend le pont entre le site et le registre lisible par un programme. Un identifiant est unique par construction, là où un nom peut être partagé ; c'est l'attribut de rapprochement le plus sûr.

Portrait de Kamel Malek
Kamel Malek
Fondateur & directeur de l'agence

Praticien du référencement depuis 2001, Kamel Malek dirige SEO360 (Alicante, Valence, Madrid, Paris). Il a publié trois ouvrages sur la visibilité dans les moteurs génératifs, dont Generative Engine Optimization et Rétablir les faits.