datos estructurados

etiquetas ocultas que explican el contenido a las máquinas

Por Yapci Bello ·

Información que se añade al código de la página para decirle a la máquina qué es cada cosa: esto es un autor, esto una fecha, esto un precio. La persona no los ve; el buscador y los modelos de inteligencia artificial sí.

El problema que resuelven

Una máquina que lee tu web ve texto, no significado. Encuentra «922 24 XX XX» y tiene que adivinar si eso es un teléfono, una referencia de producto o un número de expediente. Encuentra «Yapci Bello» debajo de un artículo y tiene que deducir si es el autor, el protagonista o alguien mencionado de pasada. Encuentra «desde 300 €» y no sabe si es el precio, un descuento o una cifra que aparece en el texto.

Los datos estructurados eliminan la adivinanza. Son un bloque de información que se añade al código de la página, invisible para quien la visita, en el que declaras de forma explícita: esto es un teléfono, esto es el autor, esto es un precio en euros. Nada más. No cambian lo que se ve, no mejoran el texto, no son un truco de posicionamiento. Solo eliminan ambigüedad.

El vocabulario que se usa para decirlo se llama schema.org: un diccionario compartido, mantenido entre Google, Microsoft, Yahoo y Yandex desde 2011, con tipos (Person, Organization, Article…) y propiedades (name, telephone, datePublished…). Ese vocabulario se escribe en un formato concreto, normalmente JSON-LD, que es un tema aparte: aquí hablamos de qué se declara y por qué, no de cómo se teclea.

Qué gana una web con esto

Hay dos beneficios distintos y conviene no mezclarlos.

Los resultados enriquecidos. Algunos tipos hacen que tu resultado en Google se vea diferente: estrellas de valoración, migas de pan en vez de la URL cruda, fechas de eventos, imágenes de recetas. Es el beneficio visible y el que todo el mundo persigue. Ojo: Google decide si los muestra o no, y solo para unos pocos tipos concretos. Marcar algo no obliga a nadie a enseñarlo.

La comprensión de la entidad. Este es el importante y casi nadie lo menciona, porque no se ve. Cuando declaras que tu web pertenece a una organización con este nombre, esta dirección, este identificador y estos perfiles oficiales, estás dándole a la máquina una ficha inequívoca de quién eres. Eso sirve para que no te confundan con otro que se llama parecido, y sirve —cada vez más— para que los sistemas que redactan respuestas sepan a quién están citando.

Yo he pasado de vender lo primero a explicar lo segundo. Los resultados enriquecidos son una lotería que Google reparte cuando quiere; la identidad bien declarada es un activo que se queda.

Los tipos que de verdad necesita un negocio pequeño

schema.org tiene más de ochocientos tipos. Vas a usar seis. Este es el conjunto que monto en prácticamente todos los proyectos, y el orden en que lo hago:

Organization — quién eres como empresa: nombre exacto, logotipo, web, formas de contacto y, sobre todo, sameAs con las URLs de tus perfiles oficiales. Ese sameAs es el que une tu web con tu ficha de empresa, tu LinkedIn y tu perfil profesional, y convierte cuatro presencias sueltas en una sola identidad.

LocalBusiness — si atiendes en un sitio físico o en una zona concreta. Es una especialización de la anterior que añade dirección postal, coordenadas, horarios y área de servicio. Si tienes local con horario de atención, este es el tipo que más rendimiento da por esfuerzo invertido.

Person — la persona que hay detrás. En marca personal y servicios profesionales es el tipo central, no un accesorio: es lo que permite que autor, empresa y trayectoria queden enlazados. La clave está en darle un identificador propio y reutilizar siempre el mismo en todas las páginas donde aparezca esa persona. Una persona, un identificador, no uno por página.

Article — para las entradas del blog. Aporta el titular, la fecha de publicación, la de actualización y, lo más importante, el autor apuntando al Person de antes. Es la forma normalizada de decir «esto lo escribió esta persona concreta en esta fecha concreta», que es exactamente la señal que sostiene el E-E-A-T.

FAQPage — preguntas y respuestas de una página. Google recortó su visibilidad en resultados en 2023, así que ya no lo pongo esperando estrellas ni desplegables. Lo pongo porque delimita la pregunta y su respuesta de forma inequívoca, y eso es material fácil de recuperar para un sistema que compone respuestas. Condición innegociable: las preguntas y respuestas tienen que estar visibles en la página. Si no están, es marcado engañoso.

BreadcrumbList — las migas de pan. El tipo más barato de implementar y el que más veces he visto reflejado en los resultados: sustituye la URL larga por la ruta legible de secciones. Además le explica al buscador la jerarquía real de tu sitio.

Con esos seis está cubierto el 95 % de lo que necesita una web de servicios. Lo demás —Product, Event, Recipe, JobPosting— solo tiene sentido si tu negocio va literalmente de eso.

Por qué le importa a un negocio

Porque el coste es bajo y la vida útil es larga. Se implementa una vez, se genera automáticamente desde la plantilla del sitio y sigue funcionando años después sin que nadie lo toque. Comparado con cualquier otra partida de un proyecto de visibilidad, es de lo más rentable que hay.

Y porque el terreno se ha movido. Cuando los datos estructurados solo servían para sacar estrellitas, era razonable considerarlos opcionales. Ahora que hay sistemas redactando respuestas sobre tu negocio, dejar que adivinen a qué te dedicas, dónde estás y quién firma tus contenidos es una decisión con consecuencias. Declararlo cuesta una tarde.

Errores frecuentes

Marcar lo que no está en la página. Es la infracción más común y la que tiene sanción explícita en las directrices de Google: valoraciones que no existen, preguntas frecuentes invisibles, precios que no aparecen. El marcado tiene que describir lo que hay, no lo que te gustaría tener.

Esperar que suba el posicionamiento. No es un factor de posicionamiento. Puede hacer que tu resultado se vea mejor y que te entiendan mejor, y ambas cosas tienen efectos indirectos. Pero marcar una página mediocre no la convierte en una buena página.

Un identificador distinto en cada página. Si el mismo autor aparece con un identificador nuevo en cada artículo, has creado veinte personas diferentes en vez de una con veinte artículos. El identificador se define una vez y se reutiliza.

Ponerlo a mano página por página. Copiar y pegar el bloque en cada plantilla garantiza que en seis meses la mitad tenga datos viejos. Se genera desde los datos reales del sitio, con una única fuente de verdad, o acaba mintiendo solo.

No validarlo nunca más. Un error de sintaxis invalida el bloque entero en silencio: no hay aviso, simplemente deja de existir. Pasar la prueba de resultados enriquecidos después de cada cambio de plantilla lleva dos minutos y evita meses de marcado muerto.

Dónde trato datos estructurados a fondo

Ver los 7 artículos de GEO →

¿Quieres que lo implementemos por ti?

Yo diseño la estrategia; la ejecuta mi equipo en SMedialab, la agencia que cofundé en Tenerife.

Ir a SMedialab →

Buscador del sitio

Escribe al menos dos letras para buscar.