Acerca de y metodología

Cómo funciona el conjunto de datos y qué significan los números.

Qué es

Schema.org, en colaboración con Google, publica un conjunto de datos público sobre el uso real de los términos del vocabulario (tipos como Person o propiedades como price) en millones de dominios web. Este panel ofrece una lectura visual, a modo de observatorio.

Cómo se recogen los datos

  • Recogida: las frecuencias de los términos se miden en la infraestructura de rastreo público de Google y se agregan por dominio (no por página): usar un término en 100 páginas del mismo sitio cuenta como un dominio.
  • Agrupación: en lugar de números exactos (ruidosos), los sitios se agrupan en franjas de popularidad por estabilidad y privacidad.
  • Publicación: cada mes se publica un nuevo archivo en GitHub.

Las franjas de dominios

Cada término se clasifica en una de estas franjas, del menor al mayor número de dominios únicos:

< 1K1K - 10K10K - 100K100K - 1M1M - 10M10M+

La franja < 1K incluye tanto términos nuevos como muy especializados (p. ej. médicos o gubernamentales): no significa que se ignoren.

Notas importantes

  • Los datos no distinguen entre JSON-LD, Microdata o RDFa: se cuentan juntos.
  • Las estadísticas reflejan la web tal como la indexa Google; ningún rastreo cubre toda la web.
  • El formato es abierto: otros rastreadores pueden aportar sus propias estadísticas en el mismo formato.

Descarga los datos

Descarga los datos en bruto del último mes:

Este proyecto

Proyecto independiente y no afiliado a Schema.org o Google.

Meses disponibles: Mayo de 2026, Junio de 2026, Julio de 2026.

SchemaStatsBot

Cuando alguien usa el validador, nuestro rastreador descarga esa pagina en su nombre. Respeta robots.txt, no rastrea la web en masa y puede bloquearse en cualquier momento.

Documentacion del bot

Fuentes