Auditoría gratis 48 h
Búsqueda generativa11 min de lectura

Claude y la búsqueda web: cómo Anthropic selecciona y cita sus fuentes.

Claude es el motor generativo más discreto con sus fuentes y el más exigente al elegirlas. Solo busca cuando lo necesita, retiene pocas páginas y cita pasajes precisos en lugar de sitios. Para una marca, esto cambia la manera de escribir y de verificar. Este artículo reúne lo que Anthropic ha documentado, lo que observamos en nuestros paneles y los controles propios de este motor.

Índice del artículo

Claude solo busca cuando lo necesita: la primera diferencia con ChatGPT

En Claude, la búsqueda web es una herramienta que el modelo decide utilizar, no un modo permanente. Según Anthropic, Claude evalúa si la pregunta exige una información reciente o verificable; si su conocimiento basta, responde sin buscar y sin citar. Cuando busca, puede encadenar varias búsquedas, cada una informada por los resultados de la anterior, antes de redactar. Un modo de investigación en profundidad, que multiplica estas etapas y produce síntesis largas y con fuentes, se añade para las preguntas complejas.

Esta selectividad tiene una consecuencia directa sobre lo que una marca puede esperar. Las preguntas de definición, de cultura general o de método estable rara vez desencadenan una búsqueda; lo que Claude dice de ellas procede de su entrenamiento y no se atribuye. Las preguntas sobre hechos fechados, precios, comparaciones entre ofertas con nombre o proveedores sí desencadenan una búsqueda, y es ahí donde sus páginas pueden aparecer. En nuestros paneles, la proporción de preguntas que desencadenan una búsqueda es menor en Claude que en ChatGPT, y mucho menor que en Perplexity, que busca sistemáticamente.

Esquema 1El recorrido de una pregunta en Claude, desde la decisión de utilizar la herramienta de búsqueda hasta la respuesta con citas.
  1. 01PreguntaEl usuario plantea su pregunta; la búsqueda web está activada en los ajustes.
  2. 02DecisiónEl modelo juzga si su conocimiento basta. Sin búsqueda, no se cita ninguna fuente: su página ni siquiera es candidata.
  3. 03Búsquedas sucesivasUna primera consulta, y luego otras, afinadas a partir de los resultados obtenidos.
  4. 04LecturaLas páginas retenidas las abre Claude-User para extraer los pasajes útiles.
  5. 05RespuestaTexto corto, pocas fuentes, cada cita anclada en un pasaje preciso.

La etapa de decisión es la que se olvida en las comparaciones entre motores. Una cuota de citación baja en Claude no siempre significa que sus páginas se descarten; a veces significa que la búsqueda no se desencadenó en las preguntas de su panel. Distinguir ambos casos es la primera lectura que hay que hacer, anotando para cada respuesta si hubo búsquedas.

ClaudeBot, Claude-SearchBot, Claude-User: tres agentes, tres papeles

Anthropic documenta tres agentes, que responden al mismo reparto que en OpenAI: entrenamiento, índice de búsqueda, lectura a petición. Cada uno se declara por su nombre y se controla por separado en el archivo robots.txt, que Anthropic indica respetar.

AgentePapel documentadoEfecto de un bloqueoCómo verificarlo
ClaudeBotRecogida de contenidos para el entrenamiento y la mejora de los modelosNinguno sobre la búsqueda web de ClaudePresencia en los logs, a menudo en volumen
Claude-SearchBotRastreo destinado a mejorar la calidad de los resultados de búsquedaSus páginas salen de los resultados que Claude consultaVisitas regulares a las páginas importantes
Claude-UserConsulta de una página a petición de un usuario, para responderClaude indica que no puede acceder a la páginaVisitas puntuales, correlacionadas con las preguntas planteadas

Tabla: desplácese horizontalmente.

El bloqueo involuntario adopta aquí una forma particular. ClaudeBot es conocido por sus numerosas visitas, y muchos administradores lo han bloqueado en el cortafuegos con una regla basada en el patrón «Claude». Esa regla atrapa también a Claude-SearchBot y a Claude-User. El sitio cree haber rechazado el entrenamiento; en realidad ha desaparecido de las respuestas. La verificación se hace en los logs del servidor, agente por agente, durante al menos treinta días.

# Visitas de los tres agentes de Anthropic en los últimos 30 días, por código de respuesta
grep -E "ClaudeBot|Claude-SearchBot|Claude-User" access.log \
  | awk '{print $9, $0 ~ /Claude-SearchBot/ ? "SearchBot" : ($0 ~ /Claude-User/ ? "User" : "ClaudeBot")}' \
  | sort | uniq -c

# Resultado esperado: códigos 200 para SearchBot y User. Los 403 o 429 señalan un bloqueo.

Lo que Anthropic ha documentado, y lo que no ha dicho

La transparencia de Anthropic abarca los agentes, el comportamiento de la herramienta de búsqueda y el formato de las citas. No abarca el índice. Que sepamos, Anthropic no ha descrito la arquitectura de búsqueda que alimenta a Claude, ni la parte respectiva de un índice propio y de proveedores externos. Un proveedor de búsqueda externo figura en la lista de subencargados publicada por el editor, algo que los observadores señalaron desde el lanzamiento; el papel exacto de Claude-SearchBot en la construcción de los resultados no se detalla más allá de la fórmula «mejorar la calidad de los resultados de búsqueda».

Lo que el editor documenta con precisión concierne sobre todo a los desarrolladores. La herramienta de búsqueda web está disponible en la interfaz de programación de Claude, con la posibilidad de restringir las búsquedas a una lista de dominios autorizados o de excluir algunos. Cada respuesta va acompañada de citas que contienen la URL, el título de la página y el pasaje exacto utilizado. Esta precisión, que existe también en la aplicación, es lo que más distingue a Claude de los demás motores, y volvemos a ella más adelante.

El punto B2B que conviene retener: una parte creciente de los usos de Claude pasa por asistentes de empresa construidos sobre esta interfaz, en los que el editor del asistente elige los dominios consultados. Figurar en esas listas no se trabaja con el posicionamiento, sino con la relación comercial y la reputación; es un canal distinto, que hay que tener presente cuando un cliente dice «nosotros usamos Claude».

Las exigencias de accesibilidad: lo que Claude debe poder leer

Como Claude lee pocas páginas, las lee enteras. La etapa de lectura por Claude-User es en la que constatamos más fallos silenciosos: la página se ha encontrado, pero lo que vuelve está vacío, truncado o sustituido por una página de error. Cuatro exigencias cubren la casi totalidad de los casos.

Esquema 2Las cuatro exigencias de accesibilidad que se verifican antes de que Claude pueda citar un pasaje.
  1. 1HTML completoEl contenido principal está en la respuesta del servidor, sin ejecución de JavaScript ni interacción.Si no: Claude lee un título y un menú, y pasa a la página siguiente.
  2. 2Respuesta rápida y estableUn tiempo de respuesta corto, sin redirecciones en cadena ni página intermedia.Si no: la lectura se abandona antes de agotar el plazo.
  3. 3Sin desafío anti-robotNinguna prueba JavaScript, ninguna página de verificación, ninguna limitación de frecuencia sobre los agentes declarados.Si no: Claude indica al usuario que no ha podido acceder al sitio.
  4. 4robots.txt coherenteTres reglas distintas para tres agentes, y la misma política en el CDN y el cortafuegos.Si no: el rechazo del entrenamiento borra también la búsqueda.

El tercer punto merece insistencia. Claude es explícito cuando una página se le resiste: escribe que no ha podido acceder a ella y responde a partir de otras fuentes. Para el usuario, su sitio aparece entonces como cerrado, y la fuente competidora como abierta. Es un efecto de reputación directo, visible en la conversación, que los demás motores no exponen con tanta claridad.

El estilo de cita de Claude y lo que implica para sus páginas

Claude cita poco, y cita con precisión de pasaje. Donde ChatGPT inserta un enlace tras una frase y Perplexity un número, Claude vincula cada afirmación al extracto exacto que la justifica, consultable por el usuario. La respuesta es en general más corta, con entre dos y cinco fuentes, y una lista de fuentes al final del mensaje.

Esquema 3Anatomía de una cita en Claude: la afirmación, el pasaje exacto y la fuente.
Afirmación
«El plazo medio constatado antes de las primeras citas es de seis a diez semanas.»
Pasaje citado
«En nuestros encargos, las primeras citas aparecen generalmente entre seis y diez semanas después de implantar los datos estructurados y reescribir las páginas principales.»
Fuente
Título de la página y URL, recogidos en la lista final.
Lo que no figura
El nombre de la empresa, si el pasaje no lo contiene: Claude cita el extracto, no al autor.

Este anclaje en el extracto tiene tres implicaciones para la redacción.

  • El pasaje debe sostenerse solo, palabra por palabra. Lo que el usuario leerá al hacer clic es su frase, no una paráfrasis; una frase que empieza por «esta» o «como se ha visto más arriba» es inutilizable.
  • El nombre de la entidad debe estar en el pasaje. Claude cita el extracto y la URL; si su nombre no está en la frase, la marca no aparece en la respuesta, solo en la lista de fuentes.
  • La afirmación debe ser exacta palabra por palabra. Una cifra aproximada o una promesa sin condiciones, reproducidas textualmente, comprometen su credibilidad ante un lector que verifica.

En nuestros paneles, esta exigencia favorece a las páginas que contienen frases-prueba cortas, con una cifra, una fecha y la entidad nombrada. Son las mismas propiedades que describe la segunda condición de Cómo ser citado por ChatGPT, Claude y Perplexity, llevadas un paso más allá: en Claude, la cita es una reproducción, no una reformulación.

Claude frente a ChatGPT: lo que cambia para una marca

Los dos motores comparten la arquitectura de tres agentes y el principio de una búsqueda desencadenada por el modelo. Difieren en la frecuencia de la búsqueda, el número de fuentes, la forma de la cita y el perfil de los usuarios. El esquema resume estas diferencias tal como las medimos en un mismo panel.

Esquema 4Claude y ChatGPT en un mismo panel de preguntas B2B: cuatro diferencias de comportamiento.
Respuestas con búsqueda desencadenada
44 %
68 %
Respuestas que citan más de cinco fuentes
12 %
39 %
Citas ancladas en un pasaje exacto
92 %
30 %
Respuestas que citan al menos un sitio de marca
35 %
41 %
ClaudeChatGPT

Datos ilustrativos. Qué leer en ellos: Claude busca menos y cita menos, pero cita con más precisión; una marca presente en Claude lo está por una frase exacta, y cada plaza vale más.

De ahí se derivan tres diferencias prácticas. Primero, la preparación de las páginas para Claude se centra en la calidad de unas pocas frases más que en el volumen de secciones. Segundo, la medición debe anotar si la búsqueda tuvo lugar, pues de lo contrario la cuota de citación mezcla dos fenómenos. Por último, el perfil de los usuarios difiere: Claude está muy presente en los usos profesionales y técnicos, donde la pregunta la plantea a menudo alguien que redacta, programa o analiza, y que irá a leer la fuente. La mecánica propia de ChatGPT se detalla en ChatGPT Search: lo que se sabe de la selección de fuentes; la de Perplexity, más cercana a Claude en su precisión, en Perplexity: anatomía de una respuesta.

Prepararse: los controles propios de Claude

Como complemento de las cuatro condiciones generales, estos son los controles que añadimos para este motor, en el orden en que los ejecutamos.

  1. Releer las reglas del cortafuegos y del CDN en busca de un patrón «Claude» o «Anthropic» aplicado sin distinción de agente; sustituirlo por tres reglas nominativas.
  2. Contar las visitas de Claude-SearchBot y de Claude-User en los logs, con sus códigos de respuesta, durante treinta días. Ninguna visita, en un sitio que otros motores sí citan, señala un bloqueo aguas arriba.
  3. Pedir a Claude que abra una página concreta y resuma su contenido. Un resumen que solo recoge el título o el menú revela un contenido ausente del HTML inicial.
  4. Aislar, en cada página prioritaria, dos o tres frases-prueba que contengan la entidad nombrada, una cifra y una fecha, y verificar que son exactas palabra por palabra.
  5. Anotar, en el panel semanal, si la búsqueda se desencadenó, y calcular la cuota de citación solo sobre las respuestas con búsqueda, además de la cuota global.
  6. Inventariar los asistentes de empresa construidos sobre Claude en su sector, cuando sus clientes los utilizan, y verificar si sus dominios figuran entre sus fuentes autorizadas.

En Google, la lógica es distinta: la selección se apoya en el índice clásico y en una capa de entidades, el Knowledge Graph, que pesa más que la propia página. Es el objeto del artículo siguiente, Gemini y Google: índice clásico, Knowledge Graph y respuestas generadas.

Qué recordar

Lo esencial
  • Claude solo busca cuando lo necesita; sin búsqueda, no se cita ninguna fuente. Mida la cuota de citación solo sobre las respuestas con búsqueda.
  • Tres agentes: ClaudeBot para el entrenamiento, Claude-SearchBot para la búsqueda, Claude-User para la lectura a petición. Una regla «Claude» en el cortafuegos bloquea a los tres.
  • Anthropic documenta los agentes y el formato de las citas, no la arquitectura del índice; sea prudente con lo que no está publicado.
  • Claude cita con precisión de pasaje: la frase citada se reproduce, debe sostenerse sola, nombrar la entidad y ser exacta.
  • Frente a ChatGPT, Claude busca menos, cita menos y con más precisión; cada plaza vale más, y sus usuarios leen las fuentes.

Preguntas frecuentes

¿Bloquear ClaudeBot retira mi sitio de las respuestas de Claude?

No, si el bloqueo solo afecta a ClaudeBot. Este agente sirve para el entrenamiento y la mejora de los modelos; la búsqueda web se apoya en Claude-SearchBot y en Claude-User, que se controlan por separado en robots.txt. El riesgo procede de las reglas de cortafuegos o de CDN basadas en el patrón «Claude», que bloquean a los tres agentes a la vez y retiran el sitio de las respuestas sin que nadie lo haya decidido.

¿Por qué Claude no cita ninguna fuente en algunas preguntas?

Porque no ha buscado. Claude utiliza la búsqueda web como una herramienta, cuando estima que la pregunta exige una información reciente o verificable; ante una definición o un método estable, responde a partir de su entrenamiento, sin atribución. Una cuota de citación baja en Claude debe leerse, por tanto, distinguiendo las respuestas con búsqueda, en las que sus páginas pueden aparecer, de las respuestas sin búsqueda, en las que ninguna página es candidata.

¿Cómo cita Claude una página?

Vinculando cada afirmación al pasaje exacto que la justifica, con el título y la URL de la página, y listando las fuentes al final de la respuesta. La cita es una reproducción de su frase, no una paráfrasis. Debe, por tanto, sostenerse sola, contener el nombre de la entidad para que la marca aparezca en la respuesta, y ser exacta palabra por palabra, porque el lector puede verificarla con un clic.

¿Ejecuta Claude el JavaScript de mis páginas?

Que sepamos, no. La lectura por Claude-User se limita al HTML devuelto por el servidor; un contenido construido por el navegador tras la carga no se lee. La prueba más sencilla consiste en pedir a Claude que abra una página concreta y resuma su contenido: un resumen limitado al título y al menú revela que el contenido principal está ausente del HTML inicial, y que hace falta un renderizado del lado del servidor.

¿Qué diferencias hay entre Claude y ChatGPT para una marca?

Claude desencadena la búsqueda con menos frecuencia, retiene menos fuentes y cita con precisión de pasaje; ChatGPT busca con más facilidad, cita más páginas y atribuye con un enlace tras la frase. Para una marca, la preparación para Claude se centra en la calidad de unas pocas frases-prueba con nombre, cifra y fecha, y la medición debe distinguir las respuestas con y sin búsqueda. Ambos comparten la arquitectura de tres agentes.

Retrato de Kamel Malek
Kamel Malek
Fundador y director de la agencia

Profesional del posicionamiento desde 2001, Kamel Malek dirige SEO360 (Alicante, Valencia, Madrid, París). Ha publicado tres libros sobre la visibilidad en los motores generativos, entre ellos Generative Engine Optimization y Rétablir les faits.