Índice del artículo
Para qué sirven los datos estructurados en un motor generativo
Los datos estructurados sirven para una cosa precisa: hacer legible, sin ambigüedad, la entidad que publica. Un motor generativo elige sus fuentes entre pasajes y después comprueba quién los firma. El marcado schema.org, insertado en JSON-LD en el HTML, le proporciona esa identidad en una forma que un programa lee sin interpretación: un nombre, una forma jurídica, un autor, una fecha, perfiles vinculados. Es la tercera de las cuatro condiciones de una citación descritas en nuestro método completo: después de accesible y citable, identificada.
Hay que ser honesto sobre lo que se sabe. Google documenta el uso de los datos estructurados para comprender una página y activar resultados enriquecidos; AI Overviews y AI Mode se apoyan en el mismo índice que la búsqueda clásica, y la documentación de Google sobre sus funciones de IA remite a los mismos fundamentos, insistiendo en la correspondencia entre el marcado y el contenido visible. Bing explota el marcado schema.org, y Copilot se apoya en el índice de Bing. En cambio, ni OpenAI, ni Anthropic, ni Perplexity han publicado documentación que describa el uso del JSON-LD en la selección de las fuentes. Que sepamos, sus robots de búsqueda de IA leen el HTML completo, marcado incluido; lo que hacen después con él no es público.
Esta incertidumbre no cambia la decisión. El marcado cuesta unas horas en una plantilla, Google y Bing lo leen con certeza, e impone una disciplina que beneficia a todos los motores: un nombre único, un autor con nombre, una fecha sincera, perfiles coherentes. En nuestras auditorías, los sitios citados con regularidad por los cuatro motores tienen casi todos una entidad marcada y coherente; lo contrario no es cierto, pero la ausencia de marcado acompaña casi siempre a una entidad difusa.
- 1OrganizationQuién publica: nombre, forma jurídica, datos de contacto, identificadores, perfiles oficiales.Si no: la fuente es un dominio sin propietario.
- 2PersonQuién escribe: cargo, empleador, ámbitos de competencia, perfiles.Si no: el texto es anónimo.
- 3ArticleQué y cuándo: título, autor, editor, fechas de publicación y de actualización.Si no: el contenido no tiene ni fecha ni firma legibles.
- 4FAQPageQué preguntas: pares pregunta-respuesta autónomos, idénticos al texto visible.Si no: las respuestas quedan diluidas en la página.
Existen otros tipos que sirven según el sector: LocalBusiness para un establecimiento, Product y Offer para un catálogo, Event, Course, SoftwareApplication. Se añaden a los cuatro tipos de base, no los sustituyen. Un sitio que marca sus productos sin describir la organización que los vende deja que el motor adivine la mitad de la información.
Organization: la ficha de identidad del editor
El bloque Organization describe la empresa que edita el sitio. Debe aparecer una sola vez, en cada página, con el mismo contenido y el mismo identificador @id, de modo que todos los demás bloques puedan referirse a él. El nombre declarado aquí se convierte en el nombre canónico de la entidad: es el que habrá que encontrar, letra por letra, en LinkedIn, en los registros y en los directorios.
Google documenta para este tipo una lista de propiedades ampliada desde 2024, que cubre los identificadores administrativos: legalName, vatID, taxID, leiCode, duns, iso6523Code, numberOfEmployees, foundingDate. Estas propiedades no tienen ningún efecto visible en los resultados; sirven para vincular la entidad del sitio con la entidad de los registros, que es exactamente lo que un motor intenta hacer antes de conceder su confianza a una fuente.
| Propiedad | Función | Consejo |
|---|---|---|
name | Nombre comercial | Una sola grafía, repetida en todas partes |
legalName | Razón social | Tal como está inscrita en el Registro Mercantil |
url | Dirección del sitio | Dominio canónico, con el protocolo |
logo | Logotipo | Imagen accesible a los robots, legible en formato pequeño |
sameAs | Perfiles oficiales | Únicamente páginas que existen y le pertenecen |
address | Sede | Objeto PostalAddress completo, país incluido |
vatID, taxID | Identificadores fiscales | Número de IVA intracomunitario, identificador fiscal nacional |
foundingDate, founder | Origen | Año de creación, fundador vinculado por @id |
knowsAbout | Ámbitos de competencia | De tres a seis temas, en términos corrientes |
Tabla: desplácese horizontalmente.
{
"@context": "https://schema.org",
"@type": "Organization",
"@id": "https://seo360.tech/#organization",
"name": "SEO360",
"legalName": "SEO 360 ALICANTE S.L.",
"url": "https://seo360.tech",
"logo": "https://seo360.tech/img/logo.png",
"description": "Agencia de posicionamiento y búsqueda generativa (GEO), presente en Alicante, Valencia, Madrid y París.",
"email": "hola@seo360.tech",
"address": {
"@type": "PostalAddress",
"addressLocality": "Elche",
"addressRegion": "Alicante",
"addressCountry": "ES"
},
"vatID": "ES…",
"founder": { "@id": "https://seo360.tech/#kamel-malek" },
"knowsAbout": ["Posicionamiento orgánico", "Búsqueda generativa", "Datos estructurados"],
"sameAs": [
"https://www.linkedin.com/company/…",
"https://www.wikidata.org/wiki/Q…"
]
}
Dos reglas para sameAs. Incluya solo páginas que existen realmente y que hablan de usted: un perfil vacío o una dirección muerta debilita la ficha en lugar de reforzarla. Y mantenga la lista corta: de cinco a ocho perfiles actualizados valen más que veinte enlaces de los que la mitad apunta a cuentas abandonadas. La construcción de esta lista, con los registros y Wikidata, es objeto de un artículo dedicado a la entidad de marca.
Person: el autor, vinculado a la organización
Un motor generativo evalúa una fuente en parte por la persona que la firma. El bloque Person describe a ese autor con propiedades verificables: cargo, empleador, ámbitos de competencia, perfiles públicos, publicaciones. También lleva un @id estable, de modo que cada artículo, cada página de autor y el bloque Organization designan a la misma persona sin volver a describirla.
Las propiedades que pesan son las que un tercero puede confirmar. jobTitle y worksFor sitúan a la persona; knowsAbout declara sus temas; sameAs remite a perfiles en los que aparecen el mismo nombre, el mismo cargo y los mismos temas; alumniOf, hasCredential y award documentan la formación y las distinciones cuando existen. Por el contrario, una biografía de tres líneas en description, sin ningún enlace externo, no prueba nada.
{
"@context": "https://schema.org",
"@type": "Person",
"@id": "https://seo360.tech/#kamel-malek",
"name": "Kamel Malek",
"jobTitle": "Fundador y director",
"worksFor": { "@id": "https://seo360.tech/#organization" },
"url": "https://seo360.tech/#equipe",
"image": "https://seo360.tech/img/auteur-kamel-malek.jpg",
"description": "Profesional del posicionamiento desde 2001, autor de tres libros sobre la búsqueda generativa.",
"knowsAbout": ["Búsqueda generativa", "Posicionamiento orgánico", "Entidades y datos estructurados"],
"knowsLanguage": ["fr", "es", "en"],
"sameAs": [
"https://www.linkedin.com/in/…",
"https://www.amazon.fr/…"
]
}
El vínculo entre Person y Organization se establece en ambos sentidos: worksFor por un lado, founder o employee por el otro. Esta reciprocidad es lo que permite a un motor concluir que el autor y el editor forman una sola entidad coherente, y no dos nombres puestos uno al lado del otro. Lo que debe contener una página de autor, más allá del marcado, se detalla en el artículo sobre las páginas de autor.
Article y BlogPosting: qué se dice, quién lo dice, cuándo
El bloque Article, o su subtipo BlogPosting para un blog, vincula un contenido con su autor, su editor y sus fechas. Google documenta para este tipo un número reducido de propiedades recomendadas: headline, image, datePublished, dateModified, author con name y url. Es el mínimo. Para la búsqueda generativa, tres propiedades adicionales tienen valor práctico: mainEntityOfPage, que designa la dirección canónica; inLanguage, que evita confusiones en un sitio multilingüe; about o mentions, que vinculan el artículo con las entidades que trata.
La regla absoluta es la correspondencia con lo visible. La fecha declarada debe ser la que se muestra en la página; el autor declarado debe ser el de la firma; el título declarado debe ser el título principal. Una discrepancia entre el marcado y el texto es el tipo de incoherencia que un motor detecta fácilmente y que desacredita toda la ficha. La cuestión de las fechas, y lo que significa una actualización sincera, se trata en el artículo sobre las señales de frescura.
{
"@context": "https://schema.org",
"@type": "BlogPosting",
"@id": "https://seo360.tech/blog/schema-org-pour-la-recherche-generative.html#article",
"mainEntityOfPage": "https://seo360.tech/blog/schema-org-pour-la-recherche-generative.html",
"headline": "Schema.org para la búsqueda generativa: Organization, Person, Article, FAQPage",
"description": "Cuatro tipos de schema.org bastan para que un motor generativo identifique quién publica, quién escribe, qué y cuándo.",
"image": "https://seo360.tech/blog/img/027-schema-org-pour-la-recherche-generative.jpg",
"inLanguage": "fr",
"datePublished": "2026-06-25",
"dateModified": "2026-06-25",
"articleSection": "Datos estructurados",
"author": { "@id": "https://seo360.tech/#kamel-malek" },
"publisher": { "@id": "https://seo360.tech/#organization" },
"about": [
{ "@type": "Thing", "name": "Schema.org" },
{ "@type": "Thing", "name": "Búsqueda generativa" }
]
}
En un sitio de varios cientos de páginas, este bloque no se escribe a mano: se genera a partir de la plantilla, con los campos del sistema de gestión de contenidos. La única disciplina que hay que imponer a los redactores es indicar un autor real y una fecha de actualización honesta; el resto es mecánico.
FAQPage: el formato más cercano a una respuesta generada
Una sección de preguntas y respuestas marcada como FAQPage es el contenido cuya forma más se parece a lo que produce un motor generativo: una pregunta en lenguaje natural, una respuesta autónoma de cincuenta a noventa palabras. El marcado enumera estos pares en mainEntity, cada uno en forma de objeto Question cuya respuesta aceptada es un objeto Answer.
Hay que conocer el límite de este tipo en Google. Desde agosto de 2023, Google solo muestra resultados enriquecidos de FAQ para sitios gubernamentales y de salud reconocidos; para todos los demás, el marcado sigue siendo válido y se lee, pero no produce ninguna visualización particular. No es motivo para abandonarlo: conserva un valor descriptivo, obliga a escribir respuestas autónomas y no cuesta más que una sección bien estructurada. Simplemente, no lo espere como palanca de visualización.
{
"@context": "https://schema.org",
"@type": "FAQPage",
"mainEntity": [
{
"@type": "Question",
"name": "¿Hace falta un bloque JSON-LD por tipo o un solo grafo?",
"acceptedAnswer": {
"@type": "Answer",
"text": "Es preferible un solo script JSON-LD con un array @graph: los nodos Organization, Person, BlogPosting y FAQPage se declaran en él una vez y se referencian por @id, lo que evita los duplicados contradictorios."
}
},
{
"@type": "Question",
"name": "¿Sigue produciendo un resultado enriquecido el marcado FAQPage?",
"acceptedAnswer": {
"@type": "Answer",
"text": "En Google, solo para sitios gubernamentales o de salud reconocidos, desde agosto de 2023. Para los demás, el marcado sigue siendo válido pero no tiene visualización dedicada."
}
}
]
}
Tres reglas de contenido condicionan la validez de este bloque: cada pregunta marcada debe ser visible en la página, con su respuesta, en los mismos términos; el marcado no debe servir para insertar respuestas promocionales ausentes del texto; y una página no debe llevar más que un solo bloque FAQPage. Una sección de cuatro a seis preguntas, cada una respondiendo a una formulación que realmente plantean sus compradores, vale más que una lista de veinte preguntas retóricas.
Los errores de marcado que desacreditan una fuente
Un marcado falso es peor que la ausencia de marcado, porque da al motor una razón precisa para dudar. Los errores siguientes se repiten en casi todas nuestras auditorías; cada uno se corrige en menos de un día.
- Dos bloques Organization contradictorios en la misma página, uno inyectado por el tema y otro por una extensión, con dos nombres distintos.
- Un autor genérico («admin», «equipo editorial», el nombre del sitio) donde se espera el nombre de una persona.
- Una
dateModifiedrenovada en cada generación de la página, sin cambio de contenido. - Enlaces
sameAshacia perfiles vacíos, cuentas abandonadas o páginas que no mencionan a la empresa. - Un bloque
AggregateRatingsobre la propia organización, alimentado con reseñas recogidas en el sitio: Google excluye estas valoraciones autoatribuidas de sus resultados enriquecidos, y un motor generativo no tiene ninguna razón para creerlas. - Una FAQPage cuyas preguntas no figuran en el texto visible.
- Un marcado Article en páginas que no son artículos: inicio, categorías, fichas de producto.
- Un bloque sintácticamente válido pero vacío de sentido:
namerellenado, todo lo demás ausente.
Las extensiones de SEO de los principales sistemas de gestión de contenidos generan un marcado por defecto. Suele ser correcto, rara vez completo, y entra en conflicto con cualquier bloque añadido a mano. Antes de escribir una línea, inventaríe lo que el sitio ya emite, página por página, y decida una única fuente de verdad.
Validar, desplegar, vigilar
Un marcado se valida en tres niveles, y cada nivel atrapa errores que los demás dejan pasar. El validador de schema.org (validator.schema.org) comprueba la sintaxis y la existencia de los tipos y propiedades. La prueba de resultados enriquecidos de Google comprueba la elegibilidad para las visualizaciones que Google admite, y señala las propiedades que faltan para ellas. La lectura humana, por último, comprueba lo que ninguna herramienta controla: que el nombre, el autor y la fecha declarados son realmente los que muestra la página.
- 01InventarioRegistrar todos los bloques JSON-LD emitidos por la plantilla, el tema y las extensiones.
- 02SintaxisPasar cada plantilla por validator.schema.org: tipos y propiedades existentes, JSON válido.
- 03ElegibilidadProbar una página por plantilla en la prueba de resultados enriquecidos de Google.
- 04CoherenciaComparar nombre, autor, fechas y preguntas con el texto mostrado. Toda discrepancia es un error.
- 05SeguimientoLeer los informes de mejoras de Search Console después de cada despliegue.
El despliegue sigue el orden de los tipos. Primero la organización, porque todo lo demás se refiere a ella; después los autores; luego las plantillas de artículo y, por último, las secciones de preguntas. En un sitio existente, este recorrido cabe en un trimestre, a condición de empezar por eliminar los marcados parásitos en lugar de añadir otros.
- Semanas 1 a 2Inventario y limpieza
- Registro de los bloques emitidos por el tema y las extensiones
- Eliminación de duplicados y de bloques contradictorios
- Elección de una única fuente de verdad
- Semanas 3 a 6Grafo de entidad
- Organization con @id, en todas las páginas
- Person para cada autor, páginas de autor vinculadas
- Plantilla Article o BlogPosting generada desde el CMS
- Semanas 7 a 12Extensión y seguimiento
- FAQPage en las páginas que contienen preguntas visibles
- Tipos sectoriales: LocalBusiness, Product, Event
- Control mensual en Search Console y relectura de una muestra
El seguimiento no termina con el despliegue. Una actualización del tema, una nueva extensión o un cambio de plantilla pueden reintroducir un bloque parásito sin que nadie lo note. Una relectura mensual de una muestra de páginas, cruzada con los informes de Search Console, basta para detectar estas regresiones antes de que cuesten citaciones.
Qué recordar
- Los datos estructurados no hacen que se cite una página; hacen legible la entidad que la firma, que es la tercera condición de una citación.
- Cuatro tipos bastan para empezar: Organization, Person, Article o BlogPosting, FAQPage, vinculados por identificadores
@iden un solo grafo. - Google y Bing leen este marcado de forma documentada; OpenAI, Anthropic y Perplexity no han publicado nada al respecto, lo que no resta nada a su valor como disciplina.
- La regla absoluta es la correspondencia con lo visible: nombre, autor, fechas y preguntas declarados deben ser los de la página.
- Un marcado falso es peor que la ausencia de marcado; inventaríe y limpie antes de añadir, valide en tres niveles, relea cada mes.
Preguntas frecuentes
¿Son obligatorios los datos estructurados para ser citado por ChatGPT o Perplexity?
No. Ninguno de estos editores ha documentado el uso del marcado schema.org en la selección de sus fuentes, y páginas sin marcado se citan todos los días. En cambio, Google y Bing lo leen de forma documentada, y AI Overviews, AI Mode y Copilot se apoyan en sus índices. El marcado es, por tanto, una inversión segura para dos motores y una disciplina útil para los demás.
¿Hay que elegir entre JSON-LD, microdatos y RDFa?
Elija JSON-LD. Es el formato que Google recomienda, el más sencillo de generar desde una plantilla y el único que permite describir un grafo completo con identificadores compartidos, sin tocar el HTML del contenido. Los microdatos siguen siendo válidos, pero se dispersan por la página, lo que hace más difícil detectar las incoherencias.
¿Cómo vincular al autor de un artículo con la organización que publica?
Mediante identificadores estables. Declare la Organization con un @id, la Person con otro @id y una propiedad worksFor que apunte al primero; después, en cada Article, referencie esos identificadores en author y publisher en lugar de volver a describir las entidades. El motor reconstruye así una sola entidad coherente.
¿Sirve todavía para algo el marcado FAQPage?
Sí, pero ya no como palanca de visualización. Desde agosto de 2023, Google reserva los resultados enriquecidos de FAQ a los sitios gubernamentales y de salud reconocidos. El marcado conserva un valor descriptivo y obliga a escribir respuestas autónomas, cortas y fieles al texto visible, que es precisamente el formato que extrae un motor generativo.
¿Qué herramientas utilizar para validar un marcado?
Tres niveles: el validador de schema.org para la sintaxis y el vocabulario, la prueba de resultados enriquecidos de Google para la elegibilidad a las visualizaciones que admite, y una relectura humana para la coherencia entre el marcado y el contenido visible. Los informes de mejoras de Search Console señalan después los errores a escala del sitio.
