Datos estructurados para IA: qué schema sirve
Qué datos estructurados para IA ayudan a que ChatGPT, Perplexity y Google te citen, qué dice Google sobre el schema, y los cinco tipos que vale la pena montar.
Los datos estructurados para IA son un bloque de código, normalmente en formato JSON-LD, que le explica a una máquina qué es cada cosa de tu página: que esto es una empresa, esto un artículo, esto la persona que lo firma y esto un servicio con su precio. Para los buscadores con inteligencia artificial no son un botón mágico de citación. Son otra cosa, más aburrida y más útil: la forma más barata de que una IA no se equivoque contigo.
He gestionado cinco webs de marca a la vez, con su rebranding y su medición, y esta web la he montado yo en Astro con el schema escrito a mano. Desde que aparecieron las respuestas generadas por IA me llega la misma pregunta una y otra vez: ¿si meto schema me cita ChatGPT? La respuesta corta es no, no por sí solo. La larga es este artículo, y creo que te va a ahorrar dinero en plugins.
Puntos clave
- Google es tajante: “no hay datos estructurados de schema.org especiales que tengas que añadir” para aparecer en AI Overviews o AI Mode (Google Search Central)
- Microsoft sí lo confirma por su lado: Fabrice Canel, de Bing, explicó en SMX Munich que el schema ayuda a que sus modelos de lenguaje entiendan tu contenido (Search Engine Land, marzo de 2025)
- El marcado tiene que reflejar lo que se ve: Google exige que “sea una representación fiel del contenido de la página” y avisa de que un incumplimiento puede acabar en acción manual (Google)
- El resultado enriquecido de FAQ dejó de mostrarse el 7 de mayo de 2026, aunque el tipo
FAQPagesigue siendo marcado válido (Google)- Regla que uso: el schema no te hace citable, te hace inequívoco. Lo que te hace citable es el contenido que hay debajo
Si prefieres delegar esta parte, en mi página de consultor GEO cuento cómo trabajo la visibilidad en buscadores con IA. Pero merece la pena entender el mecanismo, porque aquí se vende mucha magia con cuota mensual incluida.
Qué son los datos estructurados, en cristiano
Tu página tiene un texto que lee una persona. Los datos estructurados son una segunda capa, invisible para el visitante, que traduce ese mismo texto a un formato que una máquina no puede malinterpretar.
Un ejemplo. Tu página pone “Clínica Dental Sur, Málaga, abierto de 9 a 20, desde 45 euros la revisión”. Una IA lee eso y tiene que deducir qué es un nombre, qué es un horario y qué es un precio. Casi siempre acierta, pero acierta con una probabilidad, no con una certeza. Con schema le entregas lo mismo ya masticado:
{
"@context": "https://schema.org",
"@type": "Dentist",
"name": "Clínica Dental Sur",
"address": {
"@type": "PostalAddress",
"addressLocality": "Málaga",
"addressCountry": "ES"
},
"openingHours": "Mo-Fr 09:00-20:00",
"url": "https://ejemplo.com/"
}
Ya no hay deducción. Hay un dato con su etiqueta. Esa es toda la idea, y por eso el schema es una de esas capas invisibles que sostienen el resto: no luce nada, y quita ambigüedad a coste casi cero.
El formato recomendado es JSON-LD, un bloque <script type="application/ld+json"> que va en el <head> o en el <body> de la página. No toca tu diseño, no cambia una coma de lo que ve el usuario y se puede añadir a cualquier web.
Lo que Google dice sobre schema e IA
Aquí conviene ir a la fuente en vez de al hilo de LinkedIn. La documentación oficial de Google sobre funciones de IA en la búsqueda dice, con estas palabras, que “no hay datos estructurados de schema.org especiales que tengas que añadir” y que “no hay requisitos adicionales para aparecer en AI Overviews o AI Mode, ni otras optimizaciones especiales necesarias” (Google Search Central).
O sea: no existe un AIOverviewSchema que active la citación. Quien te venda eso, o no ha leído la documentación o cuenta con que tú no la vas a leer.
Lo que Google sí repite es lo de siempre: contenido útil, base técnica sana, buena experiencia de página y datos estructurados alineados con el texto visible. Es decir, el schema sigue en la lista, pero como parte del trabajo normal, no como truco de IA.
Lo que dice Microsoft, que es distinto
Y aquí está el matiz que casi nadie cuenta, porque Google no es el único que responde con IA. Fabrice Canel, Principal Product Manager de Bing y responsable de la infraestructura de rastreo, confirmó en el escenario de SMX Munich que Microsoft usa el marcado schema para que sus modelos de lenguaje entiendan el contenido de las webs (Search Engine Land, marzo de 2025). En la misma charla añadió que las IA generativas valoran especialmente el contenido fresco, porque lo usan como contraste de sus propios datos de entrenamiento, y recomendó empujar las actualizaciones vía IndexNow.
Eso importa más de lo que parece. Copilot se apoya en el índice de Bing, y buena parte de los asistentes que hay en el mercado también beben de ahí. Así que tenemos a un buscador diciendo “no hace falta nada especial” y a otro diciendo “sí, lo usamos”. Con dos señales así, la decisión práctica es fácil: el schema es barato de poner y no tiene contraindicación, así que se pone.
Para qué sirven los datos estructurados para IA
Para tres cosas concretas, y ninguna es “salir en ChatGPT” por arte de magia.
Para desambiguar tu entidad. Si tu negocio se llama igual que otros veinte en España, el modelo necesita saber cuál eres tú. El campo sameAs, apuntando a tu perfil de LinkedIn, tu ficha de Google o tu Wikidata si la tienes, ata tu web a una identidad concreta. Es la diferencia entre ser “un consultor” y ser “este consultor”.
Para verificar afirmaciones. Un precio, una fecha de publicación, un autor con sus credenciales o una valoración marcados de forma explícita son datos que una IA puede contrastar sin tener que fiarse de su interpretación del párrafo. Un modelo cita antes lo que puede verificar rápido.
Para conectar piezas entre sí. El schema no describe solo una página, describe relaciones: esta empresa publica este artículo, que lo firma esta persona, que ofrece este servicio en esta ciudad. Ese grafo es lo que convierte un montón de URLs sueltas en una marca reconocible.
Fíjate en que las tres cosas tienen algo en común: el schema no crea información nueva, hace que la que ya tienes sea imposible de malinterpretar. Si debajo no hay nada que citar, marcarlo no cambia nada. Entender por qué funciona vale más que copiar el bloque de código.
Los cinco tipos que valen la pena
El vocabulario de schema.org tiene cientos de tipos. Para una pyme, con estos vas sobrado.
- Organization (o
Personsi tu marca eres tú). Va en la home o en todo el sitio. Nombre, logo, URL,sameAscon tus perfiles y datos de contacto. Es el ancla de tu identidad, la pieza que yo montaría primero. - LocalBusiness y su subtipo (
Dentist,Restaurant,LegalService). Si atiendes en una zona, esto marca dirección, horarios, teléfono y área de servicio. Los mismos datos que en tu ficha de Google, coincidiendo al carácter. - Article o
BlogPostingen cada post, conauthor,datePublishedydateModified. Aquí es donde el schema se cruza con la experiencia demostrable que Google valora: el autor deja de ser una firma decorativa y pasa a ser una entidad enlazada. - Product con su
Offersi vendes online. Precio, moneda y disponibilidad. Es el tipo con más retorno en ecommerce, porque además da resultados enriquecidos clásicos. - BreadcrumbList. Aburrido y barato. Le explica al buscador la jerarquía de tu sitio, que es justo lo que un modelo necesita para entender de qué va cada sección.
Si tu web es de servicios locales, en mi experiencia con los tres primeros cubres casi todo el valor. El resto es afinar.
El caso FAQPage: murió el escaparate, no el marcado
Este merece párrafo propio porque genera mucha confusión. Google dejó de mostrar el resultado enriquecido de preguntas frecuentes en la búsqueda el 7 de mayo de 2026, después de haberlo anunciado un año antes, y en junio de 2026 retiró la documentación de la función (Google).
Mucha gente entendió que había que borrar el marcado. No hace falta. FAQPage sigue siendo un tipo válido de schema.org y tenerlo no penaliza. Lo que has perdido es el adorno visual en los resultados, que era la razón por la que casi todo el mundo lo puso.
Mi lectura: si tus preguntas frecuentes están ahí porque tus clientes las hacen de verdad, se quedan, marcado incluido. Si las metiste solo para pescar el resultado enriquecido, ya sabes lo que pasa con el contenido que existe para el buscador y no para la persona. Un bloque de preguntas y respuestas directas sigue siendo de lo más citable que puedes escribir, y eso no depende de ningún resultado enriquecido.
Cómo montarlo sin romper nada
Los pasos que sigo, en este orden:
- Empieza por Organization o Person en toda la web. Un solo bloque, bien hecho, con
sameAsa tus perfiles. Si tu gestor de contenidos lleva un plugin de SEO, esto suele estar ya medio puesto. - Añade el tipo de página.
Articleen los posts,LocalBusinessen la de contacto,Producten las fichas. - Enlaza las piezas con
@id. Dale una URL identificadora a tu organización y referénciala desde el resto en vez de repetir el bloque entero. Así construyes un grafo en lugar de islas. - Valida. El validador de schema.org te dice si el marcado es correcto y la prueba de resultados enriquecidos de Google te dice si además da derecho a alguna función. No son lo mismo y conviene pasar los dos.
- Vigila Search Console. El informe de mejoras te avisa de errores en producción, que es donde de verdad importan.
Y una advertencia que no me canso de repetir: no marques nada que no esté visible en la página. La política de Google pide que el marcado “sea una representación fiel del contenido” y prohíbe marcar contenido que el lector no ve, con acción manual como consecuencia posible (Google). Inventar valoraciones de cinco estrellas en el JSON-LD es la forma más rápida de perder los resultados enriquecidos del sitio entero.
Los fallos que veo más
El más común, con diferencia, es el schema huérfano: un plugin que suelta un bloque Organization genérico, sin sameAs, sin logo y con el nombre por defecto de la plantilla. Está técnicamente puesto y no aporta nada.
El segundo es la contradicción. El horario del schema dice una cosa, el pie de página dice otra y la ficha de Google una tercera. Cuando las señales se pelean, el buscador decide por su cuenta y no siempre acierta.
El tercero es el más caro en tiempo: dedicar semanas al marcado mientras la web tarda seis segundos en cargar o Google ni siquiera indexa media sección. El schema afina el mensaje, no lo sustituye. Si esa es tu situación, empieza por la auditoría SEO técnica y deja el JSON-LD para el final de la lista.
Preguntas frecuentes
¿El schema hace que ChatGPT me cite? Por sí solo, no. Ayuda a que se entienda quién eres y qué ofreces, y Microsoft ha confirmado que sus modelos lo usan, pero la citación la gana el contenido: respuestas directas, datos con fuente y una marca reconocible. Lo desarrollo en mi guía sobre cómo aparecer en ChatGPT Search.
¿Necesito schema si ya tengo llms.txt? Son cosas distintas y no compiten. El llms.txt es un índice que propone qué leer, y hoy apenas se consume, como conté en la guía de llms.txt. El schema describe lo que hay dentro de cada página y sí lo usan buscadores en producción. Si tuviera que elegir uno, me quedo con el schema.
¿Me vale con un generador automático? Para arrancar, sí. Para quedarte ahí, no. Los generadores producen bloques aislados y sin sameAs ni @id, que es justo la parte que construye tu identidad. Genera, revisa a mano y enlaza las piezas.
¿Cuánto tarda en notarse? Google suele recoger el marcado en días o pocas semanas, y en Search Console lo ves antes que en ningún sitio. El efecto sobre citaciones en IA es más lento y difícil de aislar, porque va mezclado con todo lo demás que hagas. Sé honesto contigo mismo al medirlo.
¿Y si mi web es de Wix o WordPress? Sirve igual. Los plugins de SEO ponen una base decente, y lo que suele faltar es lo de siempre: sameAs, autor bien definido y coherencia con el texto visible. Ahí es donde vale la pena meter una hora de trabajo manual.
Conclusión
Los datos estructurados no son el interruptor que te mete en las respuestas de IA. Google dice claramente que no hace falta ningún schema especial para AI Overviews, y Microsoft dice que sus modelos sí lo aprovechan. Con esas dos cosas encima de la mesa, la conclusión práctica es la misma que en casi todo el posicionamiento: es barato, no tiene contraindicación, quita ambigüedad y sostiene lo que hay encima. Ponlo bien, que refleje lo que se ve, y sigue con lo que de verdad decide la partida, que es tener contenido que merezca la cita.
Sé que al principio el JSON-LD asusta un poco. Tranquilo: con Organization y Article bien montados ya estás por delante de la mayoría de webs de tu sector.
Si quieres que revise qué marcado tiene hoy tu web y qué le falta para que las IA te entiendan, cuéntame tu caso y lo miramos juntos. Te digo por orden qué mover primero y qué puede esperar.