Los Datos Estructurados JSON-LD

Breve relato contextualizado e Historicista sobre los Datos Estructurados y Schema.org

SEO basado en entidades
Entity Based SEO

Inicio > SEO de entidades > Qué son y para qué sirven los Datos Estructurado

¿Qué son los Datos Estructurados en JSON-LD?

Escrito por Álvaro Pichó, publicado en noviembre de 2025

Como lenguaje

Los datos estructurados JSON-LD (JavaScript Object Notation for Linked Data) es el empleo del vocabulario estandarizado por la organización Schema.org que describe entidades y la relación entre éstas.

Las entidades son descritas como Tipos (Types) con Propiedades (Properties).

Y es en la descripción de las Propiedades donde personalizamos y adaptamos el vocabulario a las cualidades y circunstancias de cada empresa, persona, trabajo, lugar, etc.

Como estándar

Schema.org es fundado colaborativamente en 2011 entre Google, Microsoft (Bing), Yahoo y Yandex (Rusia), de tal manera que es un estándar aceptado y compartido por estos buscadores.

Baiud (China) no participa de Schema.org por razones políticas y regulatorias.

Esto significa que cuando declaro el Type "person", y declaro su "name", "birthDate" y "worksFor", aquellos 4 entienden que estás hablando de una persona, declarando inequívocamente su nombre, fecha de nacimiento y para quién o qué empresa trabaja.

¿Para qué sirven los Datos Estructurados?

Interpretable por las máquinas

Este vocabulario y su consecuente implementación en los sitios web es interpretable por las máquinas (machine readable) de tal manera que los algoritmos de los buscadores saben darle sentido de una manera más confiada a lo que se dice en cada sitio web.

En resumen, el propósito de Schema es la correcta comprensión por parte de las máquinas de lo manifestado por cada cual en sus sitios web.

"Por parte de las máquinas", porque todo se automatiza y el 1) rastreo, 2) la indexación y 3) la clasificación de los sitios web de todo el mundo es una labor automatizada por máquinas o programas.

Podemos decir que es una Tecnología de la Comprensión.

A los 3 puntos anteriores, habría que añadirle un 4º paso, también automatizado, para completar un relato sobre la distribución de la información en internet, que sería: 4) Servir. Es decir, cómo se sirve la información sujeto a la consulta realizada por el usuario... Aunque ese ya es otro mundo bastante alejado del tema central de los Datos Estructurados: rankings, anuncios, personalización, IAs...

Desambigüación

Cada elección implica una renuncia: cuando yo digo que soy de Valencia, digo también que no soy de Madrid...

En el mismo sentido, cuando aplicamos la definición precisa sobre algo, estamos declarando qué sí y qué no es, y en consecuencia, las máquinas, nos excluyen de Tipos y atributos o propiedades.

Quiero contar un caso de desamigüación de este mismo sitio web, seolevante.com

Hace unos años realicé por cuenta propia unas auditorías SEO a varias empresas del sector B2B con una intención didáctica del SEO hacia el mundo de la empresa.

Puesto que hablo largo y tendido sobre 4 sectores industriales distintos, este sitio web empezó a salir en búsquedas de aquellos sectores, tales como "porcelánico de gran formato, limpieza por ultrasonidos, etc.".

Lo cual destrozaba el Main Topic de mi sitio web, la consultoría SEO. Es decir, a los algoritmos los estaba confundiendo más o menos así: "Este sitio we de qué va: del SEO o del Porcelánicao... No tienen nada que ver...". Esto, por supuesto, perjudicaba a mis rankings.

¿Cómo lo resolví? Redactando un inequívoco "about" en "Article" sobre la Auditoría y el SEO, subordinando unos (mentions) a otros (about), lo muestro:

"about":[{
"@type":"DefinedTerm",
"name":"search engine optimization",
"sameAs":"https://www.wikidata.org/wiki/Q180711"
},{
"@type":"DefinedTerm",
"name":"SEO Audit",
"sameAs":"https://www.wikidata.org/wiki/Q97371007"
},{
"mentions":[{
"@type":"DefinedTerm",
"name":"industrial sector",
"sameAs":"https://www.wikidata.org/wiki/Q8148"
},{
"@type":"Thing",
"name":"porcelain stoneware",
"sameAs":"https://www.wikidata.org/wiki/Q2780343"
},],

Así conseguí re-encauzar el Main Topic de mi web y mi sitio web dejó de aparecer cuando alguien buscaba "limpieza por ultrasonidos valencia".

Definí y desambigüé... con los datos estructurados.

Este es un caso bastante extraño y a nadie le he oído hablar de casos así. Sé de lo que hablo .·)

Historia

De lo desestrucurado a lo estructurado

Desde la perspectiva del lenguaje: ¿cómo es y cómo fue el desarrollo del lenguaje en Internet? Tanto de la declaración como de la interpretación...

Antes de Internet y la Open web, ya existía la disciplina de, digamos, la semántica automatizada, es decir, tecnologías que eran capaces de darle sentido a textos creados por las personas de manera automática.

Esta disciplina es el Procesamiento del Lenguaje Natural (PLN o NLP), nacida allá por los años 50 y 60.

Cuando nace y eclosiona internet, Tim Berners-Lee arroja el NLP sobre la web con el archifamoso artículo: Semantic Web (enlace a Wikipedia).

En definitiva, el escenario es el siguiente: cualquier contenido que se publique en un sitio web es, de primeras, considerado un contenido desestructurado.

A este contenido desestructurado se le aplican las tecnologías NLP, se estructura según las reglas del NLP y se extrae su sentido.

Podemos decir que los NLP aplicados a la Open Web, es lo que se conoce como Web Semántica.

Trabajo compartido

Sin embargo, los NLP no han caminado solos.

La Web Semántica (NLPs aplicados sobre las Open web) queda del lado de los buscadores, sus algoritmos y programas.

Podemos afirmar como generalidad que la Web Semántica es la ciencia que sustenta la tecnología que emplean Google, Bing, Yahoo y Yandex en sus buscadores para clasificar y servir los sitios web.

Entonces, desde el SEO (Search Enigne Optimization), nos hacemos eco de la Web Semántica y tratamos de adaptar los sitios web de los que somos responsables a los estándares y reglas de esta web semántica.

Pero no solo asumimos sus reglas.

El llamamiento

Con la creación de Schema.org allá por 2011, se lanza un llamamiento a los creadores de sitios web para que asuman y empleen el vocabulario de Schema para ayudar en la tarea de estructuración de lo desestructurado.

Llamamiento al que responden en exclusiva los profesionales SEO.

Hay un podcast, para mi, "histórico" de cómo Ryan Levering (Google's Structured data acquisition Engineer) cuenta esta historia del "llamamiento":

"... ask people to give us their data rather than to pull it off the web pages".

Y este el camino no realizado en soledad de las Tecnologías de la Comprensión.

Quiero recuperar una diapositiva de Dawn Anderson en unas conferencias SEO en Nueva York en abril de 2025 como evidencia absoluta de lo que comento:

Coyuntura

Aunque resulte paradójico, y para los ajenos a esta área de especializción, las disciplinas de la Web Semántica y el SEO, miran con recelo los primeros a los segundos; y de reojo los segundos a los primeros.

No hay un sentimiento de comunidad entre ambas disciplinas...

Ahora mismo, diría que solo Dawn Anderson (SEO) y Ricardo Baeza-Yates (Semántica) son los únicos que se dejan ver en conferencias de los otros.

Creo firmemente que la Web semántica que queda del lado de los buscadores, y el SEO que queda del lado del resto del mundo, debieran tener una relación más robusta, si se unieran incluso brotaría un nuevo grado universitario: Distribución de la Información: creación y consulta.

Gracias por leer.

Álvaro Pichó.

Consultoría SEO Levante
Resumen de privacidad

Esta web utiliza cookies para que podamos ofrecerte la mejor experiencia de usuario posible. La información de las cookies se almacena en tu navegador y realiza funciones tales como reconocerte cuando vuelves a nuestra web o ayudar a nuestro equipo a comprender qué secciones de la web encuentras más interesantes y útiles.