Datos de uso de Schema.org para auditorías SEO
Cómo interpretar los buckets de uso por dominio de Schema.org, reproducir sus cálculos y evitar conclusiones falsas sobre páginas, formatos o ranking.
En breve: El archivo público de mayo de 2026 agrupa 5.545 términos de Schema.org según el número de dominios únicos donde Google los observó. La unidad no son páginas ni bloques JSON-LD. La distribución ayuda a comparar adopción, pero no revela factores de ranking, resultados enriquecidos ni calidad de implementación.
En una auditoría, el bucket aporta contexto. La decisión final depende de que el tipo describa la página, la información sea visible, la fuente de datos se mantenga y el marcado cumpla la documentación aplicable.
Resumen del conjunto de datos
Dos minutos para leer los buckets correctamente
El video distingue dominios, páginas, formatos y elegibilidad antes de convertir la estadística en una recomendación.
El anuncio de Schema.org presenta un conjunto creado con Google a partir del rastreo público de la web. Los archivos oficiales están disponibles en el repositorio de Schema.org como CSV y JSON.
Contenido y límites de la publicación
La documentación de estadísticas de uso fija las fronteras del dato. Las frecuencias se agregan por dominio, los conteos exactos no se publican y las sintaxis JSON-LD, Microdata y RDFa se combinan. Un sitio bloqueado para el rastreo público de Google queda fuera de la muestra.
| Campo | Lectura correcta | Uso en auditoría |
|---|---|---|
Class | Distingue tipos de propiedades. | Permite separar Itemtypes y Predicates. |
Name | Identifica el término de Schema.org. | Conecta el marcado observado con el vocabulario oficial. |
Domain Bucket | Indica un rango de dominios únicos. | Ofrece una referencia de adopción, no un conteo de URLs. |
El explorador de Natzir Turrado facilita búsquedas y filtros. Los números finales deben comprobarse en el archivo oficial correspondiente al mes analizado.
Distribución de mayo de 2026
El snapshot contiene 958 tipos y 4.587 propiedades. De los 5.545 términos totales, 4.264 aparecen en menos de 1.000 dominios. Eso equivale al 76,9% del vocabulario publicado. Solo 143 términos alcanzan un millón de dominios o más.
| Bucket de dominios | Términos |
|---|---|
10M+ | 43 |
1M - 10M | 100 |
100K - 1M | 158 |
10K - 100K | 420 |
1K - 10K | 560 |
< 1K | 4.264 |
Esta forma no convierte la cola larga en contenido prescindible. Un término médico, científico o educativo puede ser exacto y poco común a la vez. La frecuencia indica amplitud de adopción. La pertinencia exige revisar la página.
Dominios como unidad de medida
Una tienda con Product en 500.000 URLs aporta un dominio al bucket de ese término. Un publisher con Article en todo su archivo también aporta uno. Por eso el archivo no responde cuántas páginas usan un tipo, cuántos objetos existen o cuántas apariciones recibieron un resultado enriquecido.
La distinción afecta la priorización. Un bucket alto puede señalar que muchos dominios necesitan el concepto. No demuestra que cada implementación sea válida ni que todas las plantillas de un sitio lo incluyan.
Formatos combinados y conteos aproximados
Los buckets son rangos, no cifras exactas. Si Product figura entre un millón y diez millones de dominios, no se puede derivar un conteo más preciso. Tampoco se puede atribuir esa adopción a JSON-LD, porque Schema.org combina JSON-LD, Microdata y RDFa.
Para elegir una sintaxis, revisa la documentación de datos estructurados de Google, las capacidades del CMS y el costo de mantener los campos. El conjunto de uso no resuelve esa decisión.
Adopción y valor SEO
BreadcrumbList, WebSite, WebPage, Organization y Person aparecen en el bucket de más de diez millones de dominios. Su presencia refleja patrones repetidos de navegación, identidad y publicación.
Product, Offer, Article, BlogPosting, VideoObject, FAQPage y LocalBusiness están en el rango de uno a diez millones. Ese dato no recupera una función de búsqueda retirada. Por ejemplo, la adopción de FAQPage no contradice las restricciones documentadas sobre resultados enriquecidos, analizadas en la revisión de FAQ rich results.
En ecommerce, la comparación tiene una utilidad concreta. Si una tienda no mantiene precio, moneda, disponibilidad, SKU y marca, perseguir vocabulario exótico distrae del problema del producto. La preparación para experiencias de compra agéntica también depende de esa fuente de datos, no de añadir propiedades sin respaldo.
Flujo de decisión para una auditoría
- Registrar el término y el mes. El bucket puede cambiar entre snapshots.
- Comprobar la página. El tipo debe describir el contenido visible y su función.
- Revisar elegibilidad. Si existe una función de Google, usa su documentación vigente y sus políticas.
- Auditar la fuente. El CMS, feed, PIM o sistema editorial debe mantener cada valor.
- Validar el marcado. Corrige errores de sintaxis y discrepancias con la página.
- Definir el propósito. Documenta si el término mejora comprensión, QA, comercio o una función de búsqueda.
- Monitorizar plantillas. Una actualización de tema o plugin puede cambiar miles de páginas.
Prioridades para CMS y tiendas
Los equipos de CMS pueden usar el archivo para revisar qué conceptos merecen campos nativos y cuáles deben quedar como módulos opcionales. Un template editorial necesita autor, titular, imagen y fechas coherentes. Un template de producto no debería emitir Product con precios o disponibilidad inventados.
Una tienda debería comparar el marcado con el feed y con la página renderizada. Si los tres sistemas discrepan, el bucket de adopción no resuelve cuál valor es correcto. Primero se corrige la fuente de verdad.
Errores de interpretación
- Presentar la adopción como señal de ranking.
- Convertir dominios en páginas o implementaciones.
- Inventar un conteo dentro de un rango.
- Usar los datos para comparar JSON-LD con Microdata.
- Eliminar vocabulario especializado solo por su bucket bajo.
- Añadir un término común a una página que no lo representa.
- Tratar el snapshot de mayo de 2026 como una cifra permanente.
Preguntas frecuentes
¿El conjunto de datos enumera factores de ranking?
No. Describe la adopción de términos por dominios observados en el rastreo público de Google.
¿El archivo cuenta páginas o URLs?
No. Agrega dominios únicos. Un término presente en muchas URLs del mismo sitio aporta un dominio.
¿Separa JSON-LD, Microdata y RDFa?
No. La documentación de Schema.org indica que las tres sintaxis se combinan en la estadística.
¿Conviene retirar un término del bucket menor a 1.000 dominios?
Solo si es inexacto, inválido o imposible de mantener. Un caso especializado puede necesitar vocabulario poco común.
