datos estructurados
etiquetas ocultas que explican el contenido a las máquinas
Información que se añade al código de la página para decirle a la máquina qué es cada cosa: esto es un autor, esto una fecha, esto un precio. La persona no los ve; el buscador y los modelos de inteligencia artificial sí.
El problema que resuelven
Una máquina que lee tu web ve texto, no significado. Encuentra «922 24 XX XX» y tiene que adivinar si eso es un teléfono, una referencia de producto o un número de expediente. Encuentra «Yapci Bello» debajo de un artículo y tiene que deducir si es el autor, el protagonista o alguien mencionado de pasada. Encuentra «desde 300 €» y no sabe si es el precio, un descuento o una cifra que aparece en el texto.
Los datos estructurados eliminan la adivinanza. Son un bloque de información que se añade al código de la página, invisible para quien la visita, en el que declaras de forma explícita: esto es un teléfono, esto es el autor, esto es un precio en euros. Nada más. No cambian lo que se ve, no mejoran el texto, no son un truco de posicionamiento. Solo eliminan ambigüedad.
El vocabulario que se usa para decirlo se llama schema.org: un diccionario
compartido, mantenido entre Google, Microsoft, Yahoo y Yandex desde 2011, con
tipos (Person, Organization, Article…) y propiedades (name,
telephone, datePublished…). Ese vocabulario se escribe en un formato
concreto, normalmente JSON-LD, que es un tema aparte:
aquí hablamos de qué se declara y por qué, no de cómo se teclea.
Qué gana una web con esto
Hay dos beneficios distintos y conviene no mezclarlos.
Los resultados enriquecidos. Algunos tipos hacen que tu resultado en Google se vea diferente: estrellas de valoración, migas de pan en vez de la URL cruda, fechas de eventos, imágenes de recetas. Es el beneficio visible y el que todo el mundo persigue. Ojo: Google decide si los muestra o no, y solo para unos pocos tipos concretos. Marcar algo no obliga a nadie a enseñarlo.
La comprensión de la entidad. Este es el importante y casi nadie lo menciona, porque no se ve. Cuando declaras que tu web pertenece a una organización con este nombre, esta dirección, este identificador y estos perfiles oficiales, estás dándole a la máquina una ficha inequívoca de quién eres. Eso sirve para que no te confundan con otro que se llama parecido, y sirve —cada vez más— para que los sistemas que redactan respuestas sepan a quién están citando.
Yo he pasado de vender lo primero a explicar lo segundo. Los resultados enriquecidos son una lotería que Google reparte cuando quiere; la identidad bien declarada es un activo que se queda.
Los tipos que de verdad necesita un negocio pequeño
schema.org tiene más de ochocientos tipos. Vas a usar seis. Este es el conjunto que monto en prácticamente todos los proyectos, y el orden en que lo hago:
Organization — quién eres como empresa: nombre exacto, logotipo, web,
formas de contacto y, sobre todo, sameAs con las URLs de tus perfiles
oficiales. Ese sameAs es el que une tu web con tu ficha de empresa, tu
LinkedIn y tu perfil profesional, y convierte cuatro presencias sueltas en una
sola identidad.
LocalBusiness — si atiendes en un sitio físico o en una zona concreta. Es
una especialización de la anterior que añade dirección postal, coordenadas,
horarios y área de servicio. Si tienes local con horario de atención, este es el
tipo que más rendimiento da por esfuerzo invertido.
Person — la persona que hay detrás. En marca personal y servicios
profesionales es el tipo central, no un accesorio: es lo que permite que autor,
empresa y trayectoria queden enlazados. La clave está en darle un identificador
propio y reutilizar siempre el mismo en todas las páginas donde aparezca esa
persona. Una persona, un identificador, no uno por página.
Article — para las entradas del blog. Aporta el
titular, la fecha de publicación, la de actualización y, lo más importante, el
autor apuntando al Person de antes. Es la forma normalizada de decir «esto lo
escribió esta persona concreta en esta fecha concreta», que es exactamente la
señal que sostiene el E-E-A-T.
FAQPage — preguntas y respuestas de una página. Google recortó su
visibilidad en resultados en 2023, así que ya no lo pongo esperando estrellas ni
desplegables. Lo pongo porque delimita la pregunta y su respuesta de forma
inequívoca, y eso es material fácil de recuperar para un sistema que compone
respuestas. Condición innegociable: las preguntas y respuestas tienen que estar
visibles en la página. Si no están, es marcado engañoso.
BreadcrumbList — las migas de pan. El tipo más barato de implementar y el
que más veces he visto reflejado en los resultados: sustituye la URL larga por
la ruta legible de secciones. Además le explica al buscador la jerarquía real de
tu sitio.
Con esos seis está cubierto el 95 % de lo que necesita una web de servicios. Lo
demás —Product, Event, Recipe, JobPosting— solo tiene sentido si tu
negocio va literalmente de eso.
Por qué le importa a un negocio
Porque el coste es bajo y la vida útil es larga. Se implementa una vez, se genera automáticamente desde la plantilla del sitio y sigue funcionando años después sin que nadie lo toque. Comparado con cualquier otra partida de un proyecto de visibilidad, es de lo más rentable que hay.
Y porque el terreno se ha movido. Cuando los datos estructurados solo servían para sacar estrellitas, era razonable considerarlos opcionales. Ahora que hay sistemas redactando respuestas sobre tu negocio, dejar que adivinen a qué te dedicas, dónde estás y quién firma tus contenidos es una decisión con consecuencias. Declararlo cuesta una tarde.
Errores frecuentes
Marcar lo que no está en la página. Es la infracción más común y la que tiene sanción explícita en las directrices de Google: valoraciones que no existen, preguntas frecuentes invisibles, precios que no aparecen. El marcado tiene que describir lo que hay, no lo que te gustaría tener.
Esperar que suba el posicionamiento. No es un factor de posicionamiento. Puede hacer que tu resultado se vea mejor y que te entiendan mejor, y ambas cosas tienen efectos indirectos. Pero marcar una página mediocre no la convierte en una buena página.
Un identificador distinto en cada página. Si el mismo autor aparece con un identificador nuevo en cada artículo, has creado veinte personas diferentes en vez de una con veinte artículos. El identificador se define una vez y se reutiliza.
Ponerlo a mano página por página. Copiar y pegar el bloque en cada plantilla garantiza que en seis meses la mitad tenga datos viejos. Se genera desde los datos reales del sitio, con una única fuente de verdad, o acaba mintiendo solo.
No validarlo nunca más. Un error de sintaxis invalida el bloque entero en silencio: no hay aviso, simplemente deja de existir. Pasar la prueba de resultados enriquecidos después de cada cambio de plantilla lleva dos minutos y evita meses de marcado muerto.
Términos relacionados
- JSON-LD JavaScript Object Notation for Linked Data — formato de datos estructurados enlazados
- entidad quién o qué eres, para una máquina
- GEO Generative Engine Optimization — visibilidad en buscadores con inteligencia artificial
- SEO Search Engine Optimization — posicionamiento en buscadores
- E-E-A-T Experience, Expertise, Authoritativeness, Trustworthiness — experiencia, pericia, autoridad y fiabilidad
- AI Overviews los resúmenes con inteligencia artificial de Google