Sommaire de l'article
Claude ne cherche que lorsqu'il en a besoin : la première différence avec ChatGPT
Dans Claude, la recherche web est un outil que le modèle décide d'utiliser, pas un mode permanent. D'après Anthropic, Claude évalue si la question exige une information récente ou vérifiable ; si sa connaissance suffit, il répond sans chercher et sans citer. Quand il cherche, il peut enchaîner plusieurs recherches, chacune informée par les résultats de la précédente, avant de rédiger. Un mode de recherche approfondie, qui multiplie ces étapes et produit des synthèses longues et sourcées, s'ajoute pour les questions complexes.
Cette sélectivité a une conséquence directe sur ce qu'une marque peut espérer. Les questions de définition, de culture générale ou de méthode stable déclenchent rarement une recherche ; ce que Claude en dit vient de son entraînement, et n'est pas attribué. Les questions qui portent sur des faits datés, des prix, des comparaisons entre offres nommées ou des prestataires déclenchent une recherche, et c'est là que vos pages peuvent apparaître. Dans nos panels, la part de questions qui déclenchent une recherche est plus faible chez Claude que chez ChatGPT, et bien plus faible que chez Perplexity, qui cherche systématiquement.
- 01QuestionL'utilisateur pose sa question ; la recherche web est activée dans les réglages.
- 02DécisionLe modèle juge si sa connaissance suffit. Sans recherche, aucune source n'est citée : votre page n'est même pas candidate.
- 03Recherches successivesUne première requête, puis d'autres, affinées d'après les résultats obtenus.
- 04LectureLes pages retenues sont ouvertes par
Claude-Userpour en extraire les passages utiles. - 05RéponseTexte court, peu de sources, chaque citation ancrée sur un passage précis.
L'étape de décision est celle qu'on oublie dans les comparaisons entre moteurs. Une part de citation faible sur Claude ne signifie pas toujours que vos pages sont écartées ; elle signifie parfois que la recherche n'a pas été déclenchée sur les questions de votre panel. Distinguer les deux cas est la première lecture à faire, en notant pour chaque réponse si des recherches ont eu lieu.
ClaudeBot, Claude-SearchBot, Claude-User : trois agents, trois rôles
Anthropic documente trois agents, qui répondent au même découpage que chez OpenAI : entraînement, index de recherche, lecture à la demande. Ils se déclarent chacun par leur nom et se contrôlent séparément dans le fichier robots.txt, qu'Anthropic indique respecter.
| Agent | Rôle documenté | Effet d'un blocage | Comment le vérifier |
|---|---|---|---|
ClaudeBot | Collecte de contenus pour l'entraînement et l'amélioration des modèles | Aucun sur la recherche web de Claude | Présence dans les journaux, souvent en volume |
Claude-SearchBot | Exploration destinée à améliorer la qualité des résultats de recherche | Vos pages sortent des résultats que Claude consulte | Passages réguliers sur les pages importantes |
Claude-User | Consultation d'une page à la demande d'un utilisateur, pour répondre | Claude signale qu'il ne peut pas accéder à la page | Passages ponctuels, corrélés aux questions posées |
Tableau : faites défiler horizontalement.
Le blocage involontaire prend ici une forme particulière. ClaudeBot est connu pour ses passages nombreux, et beaucoup d'administrateurs l'ont bloqué au niveau du pare-feu avec une règle portant sur le motif « Claude ». Cette règle attrape aussi Claude-SearchBot et Claude-User. Le site croit avoir refusé l'entraînement ; il a en réalité disparu des réponses. La vérification se fait dans les journaux serveur, agent par agent, sur au moins trente jours.
# Passages des trois agents Anthropic sur les 30 derniers jours, par code de réponse
grep -E "ClaudeBot|Claude-SearchBot|Claude-User" access.log \
| awk '{print $9, $0 ~ /Claude-SearchBot/ ? "SearchBot" : ($0 ~ /Claude-User/ ? "User" : "ClaudeBot")}' \
| sort | uniq -c
# Résultat attendu : des 200 pour SearchBot et User. Des 403 ou 429 signalent un blocage.
Ce qu'Anthropic a documenté, et ce qu'il n'a pas dit
La transparence d'Anthropic porte sur les agents, sur le comportement de l'outil de recherche et sur le format des citations. Elle ne porte pas sur l'index. À notre connaissance, Anthropic n'a pas décrit l'architecture de recherche qui alimente Claude, ni la part respective d'un index propre et de fournisseurs externes. Un fournisseur de recherche tiers figure dans la liste des sous-traitants publiée par l'éditeur, ce que des observateurs ont relevé dès le lancement ; le rôle exact de Claude-SearchBot dans la constitution des résultats n'est pas détaillé au-delà de la formule « améliorer la qualité des résultats de recherche ».
Ce que l'éditeur documente précisément concerne surtout les développeurs. L'outil de recherche web est disponible dans l'interface de programmation de Claude, avec la possibilité de restreindre les recherches à une liste de domaines autorisés ou d'en exclure. Chaque réponse y est accompagnée de citations qui contiennent l'URL, le titre de la page et le passage exact utilisé. Cette précision, qui existe aussi dans l'application, est ce qui distingue le plus Claude des autres moteurs, et nous y revenons plus loin.
Le point B2B à retenir : une part croissante des usages de Claude passe par des assistants d'entreprise construits sur cette interface, où l'éditeur de l'assistant choisit les domaines consultés. Figurer dans ces listes ne se travaille pas par le référencement mais par la relation commerciale et la réputation ; c'est un canal distinct, qu'il faut avoir en tête quand un client dit « nous utilisons Claude ».
Les exigences d'accessibilité : ce que Claude doit pouvoir lire
Parce que Claude lit peu de pages, il les lit en entier. L'étape de lecture par Claude-User est celle où nous constatons le plus d'échecs silencieux : la page a été trouvée, mais ce qui en revient est vide, tronqué ou remplacé par une page d'erreur. Quatre exigences couvrent la quasi-totalité des cas.
- 1HTML completLe contenu principal est dans la réponse du serveur, sans exécution de JavaScript ni interaction.Sinon : Claude lit un titre et un menu, et passe à la page suivante.
- 2Réponse rapide et stableUn temps de réponse court, sans redirection en chaîne ni page intermédiaire.Sinon : la lecture est abandonnée avant la fin du délai.
- 3Pas de défi anti-robotAucun test JavaScript, aucune page de vérification, aucune limitation de débit sur les agents déclarés.Sinon : Claude indique à l'utilisateur qu'il n'a pas pu accéder au site.
- 4robots.txt cohérentTrois règles distinctes pour trois agents, et la même politique dans le CDN et le pare-feu.Sinon : le refus d'entraînement efface aussi la recherche.
Le troisième point mérite une insistance. Claude est explicite quand une page lui résiste : il écrit qu'il n'a pas pu y accéder et répond à partir d'autres sources. Pour l'utilisateur, votre site apparaît alors comme fermé, et la source concurrente comme ouverte. C'est un effet de réputation direct, visible dans la conversation, que les autres moteurs n'exposent pas aussi clairement.
Le style de citation de Claude et ce qu'il implique pour vos pages
Claude cite peu, et il cite au passage près. Là où ChatGPT insère un lien après une phrase et Perplexity un numéro, Claude rattache chaque affirmation à l'extrait exact qui la justifie, consultable par l'utilisateur. La réponse est en général plus courte, avec deux à cinq sources, et une liste des sources en fin de message.
Cette ancre sur l'extrait a trois implications pour la rédaction.
- Le passage doit tenir seul, mot pour mot. Ce que l'utilisateur lira en cliquant est votre phrase, pas une paraphrase ; une phrase qui commence par « celle-ci » ou « comme vu plus haut » est inutilisable.
- Le nom de l'entité doit être dans le passage. Claude cite l'extrait et l'URL ; si votre nom n'est pas dans la phrase, la marque n'apparaît pas dans la réponse, seulement dans la liste des sources.
- L'affirmation doit être exacte au mot près. Un chiffre approximatif ou une promesse sans condition, reproduits textuellement, engagent votre crédibilité auprès d'un lecteur qui vérifie.
Sur nos panels, cette exigence favorise les pages qui contiennent des phrases-preuves courtes, avec un chiffre, une date et l'entité nommée. Ce sont les mêmes propriétés que décrit la deuxième condition de Comment être cité par ChatGPT, Claude et Perplexity, poussées un cran plus loin : chez Claude, la citation est une reproduction, pas une reformulation.
Claude face à ChatGPT : ce qui change pour une marque
Les deux moteurs partagent l'architecture en trois agents et le principe d'une recherche déclenchée par le modèle. Ils diffèrent sur la fréquence de la recherche, le nombre de sources, la forme de la citation et le profil des utilisateurs. Le schéma résume ces écarts tels que nous les mesurons sur un même panel.
Données illustratives. Ce qu'il faut y lire : Claude cherche moins et cite moins, mais cite plus précisément ; une marque présente chez Claude l'est par une phrase exacte, et chaque place vaut davantage.
Trois différences pratiques en découlent. D'abord, la préparation des pages pour Claude porte sur la qualité de quelques phrases plutôt que sur le volume de sections. Ensuite, la mesure doit noter si la recherche a eu lieu, sans quoi la part de citation mélange deux phénomènes. Enfin, le profil des utilisateurs diffère : Claude est très présent dans les usages professionnels et techniques, où la question est souvent posée par quelqu'un qui rédige, code ou analyse, et qui ira lire la source. La mécanique propre à ChatGPT est détaillée dans ChatGPT Search : ce que l'on sait de la sélection des sources ; celle de Perplexity, plus proche de Claude dans sa précision, dans Perplexity : anatomie d'une réponse.
Se préparer : les contrôles propres à Claude
En complément des quatre conditions générales, voici les contrôles que nous ajoutons pour ce moteur, dans l'ordre où nous les exécutons.
- Relire les règles de pare-feu et de CDN à la recherche d'un motif « Claude » ou « Anthropic » appliqué sans distinction d'agent ; remplacer par trois règles nominatives.
- Compter les passages de
Claude-SearchBotet deClaude-Userdans les journaux, avec leurs codes de réponse, sur trente jours. Aucun passage avec un site par ailleurs cité par d'autres moteurs signale un blocage en amont. - Demander à Claude d'ouvrir une page précise et de résumer son contenu. Un résumé qui ne reprend que le titre ou le menu révèle un contenu absent du HTML initial.
- Isoler, sur chaque page prioritaire, deux ou trois phrases-preuves qui contiennent l'entité nommée, un chiffre et une date, et vérifier qu'elles sont exactes au mot près.
- Noter, dans le panel hebdomadaire, si la recherche s'est déclenchée, et calculer la part de citation sur les seules réponses avec recherche, en plus de la part globale.
- Recenser les assistants d'entreprise construits sur Claude dans votre secteur, quand vos clients en utilisent, et vérifier si vos domaines figurent parmi leurs sources autorisées.
Chez Google, la logique est différente : la sélection s'appuie sur l'index classique et sur une couche d'entités, le Knowledge Graph, qui pèse davantage que la page elle-même. C'est l'objet de l'article suivant, Gemini et Google : index classique, Knowledge Graph et réponses générées.
Ce qu'il faut retenir
- Claude ne cherche que lorsqu'il en a besoin ; sans recherche, aucune source n'est citée. Mesurez la part de citation sur les seules réponses avec recherche.
- Trois agents : ClaudeBot pour l'entraînement, Claude-SearchBot pour la recherche, Claude-User pour la lecture à la demande. Une règle « Claude » dans le pare-feu bloque les trois.
- Anthropic documente les agents et le format des citations, pas l'architecture de l'index ; restez prudent sur ce qui n'est pas publié.
- Claude cite au passage près : la phrase citée est reproduite, elle doit tenir seule, nommer l'entité et être exacte.
- Face à ChatGPT, Claude cherche moins, cite moins et plus précisément ; chaque place vaut davantage, et ses utilisateurs lisent les sources.
Questions fréquentes
Bloquer ClaudeBot retire-t-il mon site des réponses de Claude ?
Non, si le blocage ne vise que ClaudeBot. Cet agent sert à l'entraînement et à l'amélioration des modèles ; la recherche web s'appuie sur Claude-SearchBot et sur Claude-User, qui se contrôlent séparément dans robots.txt. Le risque vient des règles de pare-feu ou de CDN portant sur le motif « Claude », qui bloquent les trois agents à la fois et retirent le site des réponses sans que personne ne l'ait décidé.
Pourquoi Claude ne cite-t-il aucune source sur certaines questions ?
Parce qu'il n'a pas cherché. Claude utilise la recherche web comme un outil, quand il estime que la question exige une information récente ou vérifiable ; sur une définition ou une méthode stable, il répond à partir de son entraînement, sans attribution. Une part de citation faible sur Claude doit donc être lue en distinguant les réponses avec recherche, où vos pages peuvent apparaître, des réponses sans recherche, où aucune page n'est candidate.
Comment Claude cite-t-il une page ?
En rattachant chaque affirmation au passage exact qui la justifie, avec le titre et l'URL de la page, et en listant les sources en fin de réponse. La citation est une reproduction de votre phrase, pas une paraphrase. Elle doit donc tenir seule, contenir le nom de l'entité pour que la marque apparaisse dans la réponse, et être exacte au mot près, car le lecteur peut la vérifier d'un clic.
Claude exécute-t-il le JavaScript de mes pages ?
À notre connaissance, non. La lecture par Claude-User porte sur le HTML renvoyé par le serveur ; un contenu construit par le navigateur après chargement n'est pas lu. Le test le plus simple consiste à demander à Claude d'ouvrir une page précise et d'en résumer le contenu : un résumé limité au titre et au menu révèle que le contenu principal est absent du HTML initial, et qu'un rendu côté serveur est nécessaire.
Quelles différences entre Claude et ChatGPT pour une marque ?
Claude déclenche la recherche moins souvent, retient moins de sources et cite au passage près ; ChatGPT cherche plus volontiers, cite davantage de pages et attribue par un lien après la phrase. Pour une marque, la préparation pour Claude porte sur la qualité de quelques phrases-preuves nommées, chiffrées et datées, et la mesure doit distinguer les réponses avec et sans recherche. Les deux partagent l'architecture en trois agents.


