Auditoría gratis 48 h
Datos estructurados13 min de lectura

Schema.org para la búsqueda generativa: Organization, Person, Article, FAQPage.

Los datos estructurados no hacen que una página aparezca en una respuesta generada; le dicen al motor quién habla, en calidad de qué y desde cuándo. Cuatro tipos de schema.org contienen lo esencial de esa información: Organization, Person, Article y FAQPage. Para cada uno, estas son las propiedades que cuentan, un ejemplo JSON-LD completo y listo para adaptar, y después el método de validación que evita los marcados contradictorios.

Índice del artículo

Para qué sirven los datos estructurados en un motor generativo

Los datos estructurados sirven para una cosa precisa: hacer legible, sin ambigüedad, la entidad que publica. Un motor generativo elige sus fuentes entre pasajes y después comprueba quién los firma. El marcado schema.org, insertado en JSON-LD en el HTML, le proporciona esa identidad en una forma que un programa lee sin interpretación: un nombre, una forma jurídica, un autor, una fecha, perfiles vinculados. Es la tercera de las cuatro condiciones de una citación descritas en nuestro método completo: después de accesible y citable, identificada.

Hay que ser honesto sobre lo que se sabe. Google documenta el uso de los datos estructurados para comprender una página y activar resultados enriquecidos; AI Overviews y AI Mode se apoyan en el mismo índice que la búsqueda clásica, y la documentación de Google sobre sus funciones de IA remite a los mismos fundamentos, insistiendo en la correspondencia entre el marcado y el contenido visible. Bing explota el marcado schema.org, y Copilot se apoya en el índice de Bing. En cambio, ni OpenAI, ni Anthropic, ni Perplexity han publicado documentación que describa el uso del JSON-LD en la selección de las fuentes. Que sepamos, sus robots de búsqueda de IA leen el HTML completo, marcado incluido; lo que hacen después con él no es público.

Esta incertidumbre no cambia la decisión. El marcado cuesta unas horas en una plantilla, Google y Bing lo leen con certeza, e impone una disciplina que beneficia a todos los motores: un nombre único, un autor con nombre, una fecha sincera, perfiles coherentes. En nuestras auditorías, los sitios citados con regularidad por los cuatro motores tienen casi todos una entidad marcada y coherente; lo contrario no es cierto, pero la ausencia de marcado acompaña casi siempre a una entidad difusa.

Esquema 1Los cuatro tipos de schema.org que contienen la identidad de una fuente, y la pregunta a la que responde cada uno.
  1. 1OrganizationQuién publica: nombre, forma jurídica, datos de contacto, identificadores, perfiles oficiales.Si no: la fuente es un dominio sin propietario.
  2. 2PersonQuién escribe: cargo, empleador, ámbitos de competencia, perfiles.Si no: el texto es anónimo.
  3. 3ArticleQué y cuándo: título, autor, editor, fechas de publicación y de actualización.Si no: el contenido no tiene ni fecha ni firma legibles.
  4. 4FAQPageQué preguntas: pares pregunta-respuesta autónomos, idénticos al texto visible.Si no: las respuestas quedan diluidas en la página.

Existen otros tipos que sirven según el sector: LocalBusiness para un establecimiento, Product y Offer para un catálogo, Event, Course, SoftwareApplication. Se añaden a los cuatro tipos de base, no los sustituyen. Un sitio que marca sus productos sin describir la organización que los vende deja que el motor adivine la mitad de la información.

Organization: la ficha de identidad del editor

El bloque Organization describe la empresa que edita el sitio. Debe aparecer una sola vez, en cada página, con el mismo contenido y el mismo identificador @id, de modo que todos los demás bloques puedan referirse a él. El nombre declarado aquí se convierte en el nombre canónico de la entidad: es el que habrá que encontrar, letra por letra, en LinkedIn, en los registros y en los directorios.

Google documenta para este tipo una lista de propiedades ampliada desde 2024, que cubre los identificadores administrativos: legalName, vatID, taxID, leiCode, duns, iso6523Code, numberOfEmployees, foundingDate. Estas propiedades no tienen ningún efecto visible en los resultados; sirven para vincular la entidad del sitio con la entidad de los registros, que es exactamente lo que un motor intenta hacer antes de conceder su confianza a una fuente.

PropiedadFunciónConsejo
nameNombre comercialUna sola grafía, repetida en todas partes
legalNameRazón socialTal como está inscrita en el Registro Mercantil
urlDirección del sitioDominio canónico, con el protocolo
logoLogotipoImagen accesible a los robots, legible en formato pequeño
sameAsPerfiles oficialesÚnicamente páginas que existen y le pertenecen
addressSedeObjeto PostalAddress completo, país incluido
vatID, taxIDIdentificadores fiscalesNúmero de IVA intracomunitario, identificador fiscal nacional
foundingDate, founderOrigenAño de creación, fundador vinculado por @id
knowsAboutÁmbitos de competenciaDe tres a seis temas, en términos corrientes

Tabla: desplácese horizontalmente.

{
  "@context": "https://schema.org",
  "@type": "Organization",
  "@id": "https://seo360.tech/#organization",
  "name": "SEO360",
  "legalName": "SEO 360 ALICANTE S.L.",
  "url": "https://seo360.tech",
  "logo": "https://seo360.tech/img/logo.png",
  "description": "Agencia de posicionamiento y búsqueda generativa (GEO), presente en Alicante, Valencia, Madrid y París.",
  "email": "hola@seo360.tech",
  "address": {
    "@type": "PostalAddress",
    "addressLocality": "Elche",
    "addressRegion": "Alicante",
    "addressCountry": "ES"
  },
  "vatID": "ES…",
  "founder": { "@id": "https://seo360.tech/#kamel-malek" },
  "knowsAbout": ["Posicionamiento orgánico", "Búsqueda generativa", "Datos estructurados"],
  "sameAs": [
    "https://www.linkedin.com/company/…",
    "https://www.wikidata.org/wiki/Q…"
  ]
}

Dos reglas para sameAs. Incluya solo páginas que existen realmente y que hablan de usted: un perfil vacío o una dirección muerta debilita la ficha en lugar de reforzarla. Y mantenga la lista corta: de cinco a ocho perfiles actualizados valen más que veinte enlaces de los que la mitad apunta a cuentas abandonadas. La construcción de esta lista, con los registros y Wikidata, es objeto de un artículo dedicado a la entidad de marca.

Person: el autor, vinculado a la organización

Un motor generativo evalúa una fuente en parte por la persona que la firma. El bloque Person describe a ese autor con propiedades verificables: cargo, empleador, ámbitos de competencia, perfiles públicos, publicaciones. También lleva un @id estable, de modo que cada artículo, cada página de autor y el bloque Organization designan a la misma persona sin volver a describirla.

Las propiedades que pesan son las que un tercero puede confirmar. jobTitle y worksFor sitúan a la persona; knowsAbout declara sus temas; sameAs remite a perfiles en los que aparecen el mismo nombre, el mismo cargo y los mismos temas; alumniOf, hasCredential y award documentan la formación y las distinciones cuando existen. Por el contrario, una biografía de tres líneas en description, sin ningún enlace externo, no prueba nada.

{
  "@context": "https://schema.org",
  "@type": "Person",
  "@id": "https://seo360.tech/#kamel-malek",
  "name": "Kamel Malek",
  "jobTitle": "Fundador y director",
  "worksFor": { "@id": "https://seo360.tech/#organization" },
  "url": "https://seo360.tech/#equipe",
  "image": "https://seo360.tech/img/auteur-kamel-malek.jpg",
  "description": "Profesional del posicionamiento desde 2001, autor de tres libros sobre la búsqueda generativa.",
  "knowsAbout": ["Búsqueda generativa", "Posicionamiento orgánico", "Entidades y datos estructurados"],
  "knowsLanguage": ["fr", "es", "en"],
  "sameAs": [
    "https://www.linkedin.com/in/…",
    "https://www.amazon.fr/…"
  ]
}

El vínculo entre Person y Organization se establece en ambos sentidos: worksFor por un lado, founder o employee por el otro. Esta reciprocidad es lo que permite a un motor concluir que el autor y el editor forman una sola entidad coherente, y no dos nombres puestos uno al lado del otro. Lo que debe contener una página de autor, más allá del marcado, se detalla en el artículo sobre las páginas de autor.

Article y BlogPosting: qué se dice, quién lo dice, cuándo

El bloque Article, o su subtipo BlogPosting para un blog, vincula un contenido con su autor, su editor y sus fechas. Google documenta para este tipo un número reducido de propiedades recomendadas: headline, image, datePublished, dateModified, author con name y url. Es el mínimo. Para la búsqueda generativa, tres propiedades adicionales tienen valor práctico: mainEntityOfPage, que designa la dirección canónica; inLanguage, que evita confusiones en un sitio multilingüe; about o mentions, que vinculan el artículo con las entidades que trata.

La regla absoluta es la correspondencia con lo visible. La fecha declarada debe ser la que se muestra en la página; el autor declarado debe ser el de la firma; el título declarado debe ser el título principal. Una discrepancia entre el marcado y el texto es el tipo de incoherencia que un motor detecta fácilmente y que desacredita toda la ficha. La cuestión de las fechas, y lo que significa una actualización sincera, se trata en el artículo sobre las señales de frescura.

Esquema 2El grafo de una página de artículo: cuatro nodos vinculados por sus identificadores, cada uno declarado una sola vez.
Nodo 1
Organization · @id #organization · declarada en todas las páginas
Nodo 2
Person · @id #kamel-malek · worksFor → #organization
Nodo 3
BlogPosting · author → #kamel-malek · publisher → #organization · datePublished, dateModified
Nodo 4
FAQPage · mainEntity: las preguntas visibles de la página, en el mismo orden
Enlace
Un solo script JSON-LD por página, un array @graph, ningún nodo duplicado
{
  "@context": "https://schema.org",
  "@type": "BlogPosting",
  "@id": "https://seo360.tech/blog/schema-org-pour-la-recherche-generative.html#article",
  "mainEntityOfPage": "https://seo360.tech/blog/schema-org-pour-la-recherche-generative.html",
  "headline": "Schema.org para la búsqueda generativa: Organization, Person, Article, FAQPage",
  "description": "Cuatro tipos de schema.org bastan para que un motor generativo identifique quién publica, quién escribe, qué y cuándo.",
  "image": "https://seo360.tech/blog/img/027-schema-org-pour-la-recherche-generative.jpg",
  "inLanguage": "fr",
  "datePublished": "2026-06-25",
  "dateModified": "2026-06-25",
  "articleSection": "Datos estructurados",
  "author": { "@id": "https://seo360.tech/#kamel-malek" },
  "publisher": { "@id": "https://seo360.tech/#organization" },
  "about": [
    { "@type": "Thing", "name": "Schema.org" },
    { "@type": "Thing", "name": "Búsqueda generativa" }
  ]
}

En un sitio de varios cientos de páginas, este bloque no se escribe a mano: se genera a partir de la plantilla, con los campos del sistema de gestión de contenidos. La única disciplina que hay que imponer a los redactores es indicar un autor real y una fecha de actualización honesta; el resto es mecánico.

FAQPage: el formato más cercano a una respuesta generada

Una sección de preguntas y respuestas marcada como FAQPage es el contenido cuya forma más se parece a lo que produce un motor generativo: una pregunta en lenguaje natural, una respuesta autónoma de cincuenta a noventa palabras. El marcado enumera estos pares en mainEntity, cada uno en forma de objeto Question cuya respuesta aceptada es un objeto Answer.

Hay que conocer el límite de este tipo en Google. Desde agosto de 2023, Google solo muestra resultados enriquecidos de FAQ para sitios gubernamentales y de salud reconocidos; para todos los demás, el marcado sigue siendo válido y se lee, pero no produce ninguna visualización particular. No es motivo para abandonarlo: conserva un valor descriptivo, obliga a escribir respuestas autónomas y no cuesta más que una sección bien estructurada. Simplemente, no lo espere como palanca de visualización.

{
  "@context": "https://schema.org",
  "@type": "FAQPage",
  "mainEntity": [
    {
      "@type": "Question",
      "name": "¿Hace falta un bloque JSON-LD por tipo o un solo grafo?",
      "acceptedAnswer": {
        "@type": "Answer",
        "text": "Es preferible un solo script JSON-LD con un array @graph: los nodos Organization, Person, BlogPosting y FAQPage se declaran en él una vez y se referencian por @id, lo que evita los duplicados contradictorios."
      }
    },
    {
      "@type": "Question",
      "name": "¿Sigue produciendo un resultado enriquecido el marcado FAQPage?",
      "acceptedAnswer": {
        "@type": "Answer",
        "text": "En Google, solo para sitios gubernamentales o de salud reconocidos, desde agosto de 2023. Para los demás, el marcado sigue siendo válido pero no tiene visualización dedicada."
      }
    }
  ]
}

Tres reglas de contenido condicionan la validez de este bloque: cada pregunta marcada debe ser visible en la página, con su respuesta, en los mismos términos; el marcado no debe servir para insertar respuestas promocionales ausentes del texto; y una página no debe llevar más que un solo bloque FAQPage. Una sección de cuatro a seis preguntas, cada una respondiendo a una formulación que realmente plantean sus compradores, vale más que una lista de veinte preguntas retóricas.

Los errores de marcado que desacreditan una fuente

Un marcado falso es peor que la ausencia de marcado, porque da al motor una razón precisa para dudar. Los errores siguientes se repiten en casi todas nuestras auditorías; cada uno se corrige en menos de un día.

  • Dos bloques Organization contradictorios en la misma página, uno inyectado por el tema y otro por una extensión, con dos nombres distintos.
  • Un autor genérico («admin», «equipo editorial», el nombre del sitio) donde se espera el nombre de una persona.
  • Una dateModified renovada en cada generación de la página, sin cambio de contenido.
  • Enlaces sameAs hacia perfiles vacíos, cuentas abandonadas o páginas que no mencionan a la empresa.
  • Un bloque AggregateRating sobre la propia organización, alimentado con reseñas recogidas en el sitio: Google excluye estas valoraciones autoatribuidas de sus resultados enriquecidos, y un motor generativo no tiene ninguna razón para creerlas.
  • Una FAQPage cuyas preguntas no figuran en el texto visible.
  • Un marcado Article en páginas que no son artículos: inicio, categorías, fichas de producto.
  • Un bloque sintácticamente válido pero vacío de sentido: name rellenado, todo lo demás ausente.
Punto de atención

Las extensiones de SEO de los principales sistemas de gestión de contenidos generan un marcado por defecto. Suele ser correcto, rara vez completo, y entra en conflicto con cualquier bloque añadido a mano. Antes de escribir una línea, inventaríe lo que el sitio ya emite, página por página, y decida una única fuente de verdad.

Validar, desplegar, vigilar

Un marcado se valida en tres niveles, y cada nivel atrapa errores que los demás dejan pasar. El validador de schema.org (validator.schema.org) comprueba la sintaxis y la existencia de los tipos y propiedades. La prueba de resultados enriquecidos de Google comprueba la elegibilidad para las visualizaciones que Google admite, y señala las propiedades que faltan para ellas. La lectura humana, por último, comprueba lo que ninguna herramienta controla: que el nombre, el autor y la fecha declarados son realmente los que muestra la página.

Esquema 3El bucle de validación de un marcado, de la escritura al seguimiento; la etapa decisiva es la comparación con el contenido visible.
  1. 01InventarioRegistrar todos los bloques JSON-LD emitidos por la plantilla, el tema y las extensiones.
  2. 02SintaxisPasar cada plantilla por validator.schema.org: tipos y propiedades existentes, JSON válido.
  3. 03ElegibilidadProbar una página por plantilla en la prueba de resultados enriquecidos de Google.
  4. 04CoherenciaComparar nombre, autor, fechas y preguntas con el texto mostrado. Toda discrepancia es un error.
  5. 05SeguimientoLeer los informes de mejoras de Search Console después de cada despliegue.

El despliegue sigue el orden de los tipos. Primero la organización, porque todo lo demás se refiere a ella; después los autores; luego las plantillas de artículo y, por último, las secciones de preguntas. En un sitio existente, este recorrido cabe en un trimestre, a condición de empezar por eliminar los marcados parásitos en lugar de añadir otros.

Esquema 4Un despliegue tipo de los datos estructurados en un sitio existente, en tres fases.
  1. Semanas 1 a 2Inventario y limpieza
    • Registro de los bloques emitidos por el tema y las extensiones
    • Eliminación de duplicados y de bloques contradictorios
    • Elección de una única fuente de verdad
  2. Semanas 3 a 6Grafo de entidad
    • Organization con @id, en todas las páginas
    • Person para cada autor, páginas de autor vinculadas
    • Plantilla Article o BlogPosting generada desde el CMS
  3. Semanas 7 a 12Extensión y seguimiento
    • FAQPage en las páginas que contienen preguntas visibles
    • Tipos sectoriales: LocalBusiness, Product, Event
    • Control mensual en Search Console y relectura de una muestra

El seguimiento no termina con el despliegue. Una actualización del tema, una nueva extensión o un cambio de plantilla pueden reintroducir un bloque parásito sin que nadie lo note. Una relectura mensual de una muestra de páginas, cruzada con los informes de Search Console, basta para detectar estas regresiones antes de que cuesten citaciones.

Qué recordar

Lo esencial
  • Los datos estructurados no hacen que se cite una página; hacen legible la entidad que la firma, que es la tercera condición de una citación.
  • Cuatro tipos bastan para empezar: Organization, Person, Article o BlogPosting, FAQPage, vinculados por identificadores @id en un solo grafo.
  • Google y Bing leen este marcado de forma documentada; OpenAI, Anthropic y Perplexity no han publicado nada al respecto, lo que no resta nada a su valor como disciplina.
  • La regla absoluta es la correspondencia con lo visible: nombre, autor, fechas y preguntas declarados deben ser los de la página.
  • Un marcado falso es peor que la ausencia de marcado; inventaríe y limpie antes de añadir, valide en tres niveles, relea cada mes.

Preguntas frecuentes

¿Son obligatorios los datos estructurados para ser citado por ChatGPT o Perplexity?

No. Ninguno de estos editores ha documentado el uso del marcado schema.org en la selección de sus fuentes, y páginas sin marcado se citan todos los días. En cambio, Google y Bing lo leen de forma documentada, y AI Overviews, AI Mode y Copilot se apoyan en sus índices. El marcado es, por tanto, una inversión segura para dos motores y una disciplina útil para los demás.

¿Hay que elegir entre JSON-LD, microdatos y RDFa?

Elija JSON-LD. Es el formato que Google recomienda, el más sencillo de generar desde una plantilla y el único que permite describir un grafo completo con identificadores compartidos, sin tocar el HTML del contenido. Los microdatos siguen siendo válidos, pero se dispersan por la página, lo que hace más difícil detectar las incoherencias.

¿Cómo vincular al autor de un artículo con la organización que publica?

Mediante identificadores estables. Declare la Organization con un @id, la Person con otro @id y una propiedad worksFor que apunte al primero; después, en cada Article, referencie esos identificadores en author y publisher en lugar de volver a describir las entidades. El motor reconstruye así una sola entidad coherente.

¿Sirve todavía para algo el marcado FAQPage?

Sí, pero ya no como palanca de visualización. Desde agosto de 2023, Google reserva los resultados enriquecidos de FAQ a los sitios gubernamentales y de salud reconocidos. El marcado conserva un valor descriptivo y obliga a escribir respuestas autónomas, cortas y fieles al texto visible, que es precisamente el formato que extrae un motor generativo.

¿Qué herramientas utilizar para validar un marcado?

Tres niveles: el validador de schema.org para la sintaxis y el vocabulario, la prueba de resultados enriquecidos de Google para la elegibilidad a las visualizaciones que admite, y una relectura humana para la coherencia entre el marcado y el contenido visible. Los informes de mejoras de Search Console señalan después los errores a escala del sitio.

Retrato de Kamel Malek
Kamel Malek
Fundador y director de la agencia

Profesional del posicionamiento desde 2001, Kamel Malek dirige SEO360 (Alicante, Valencia, Madrid, París). Ha publicado tres libros sobre la visibilidad en los motores generativos, entre ellos Generative Engine Optimization y Rétablir les faits.