Guía para la estructuración de datos con Schema.org | JSON-LD, validación y errores comunes
Schema.org es un esquema que permite a los motores de búsqueda comprender la estructura de las páginas web mediante campos específicos, pero no garantiza un mejor posicionamiento ni es un requisito para la búsqueda impulsada por inteligencia artificial. Es más importante tener pocos campos bien definidos que muchos campos incorrectos; el contenido marcado debe ser visible en la página.
Primero, es importante distinguir entre Schema.org y la función de búsqueda de Google.
Schema.org proporciona un vocabulario genérico para describir entidades y relaciones; Google solo admite algunos de estos tipos como base para resultados de búsqueda específicos. Los sitios web pueden utilizar propiedades de Schema.org de forma efectiva, pero esto no garantiza que Google mostrará resultados enriquecidos. Antes de implementar, es importante verificar que el contenido principal de la página sea adecuado, que Google admita las funciones correspondientes y que haya suficiente información visible para poder etiquetarla de forma precisa.
¿Qué tipos de contenido se utilizan realmente en este sitio web?
Falcon utiliza un grafo pequeño y consistente, que permite que marcas, sitios web, autores y el contenido de las páginas compartan un mismo conjunto de identificadores de entidades:
Organización: Identidad de marca y datos de contacto públicos
Sitio web: Relación entre el sitio web y el editor.
Servicio: Alcance visible del servicio y proveedor.
Artículo: Contenido del artículo (incluyendo autor y fecha de publicación)
Lista de navegación: "Migas de pan"
Página de perfil/Persona: Autores con nombre y datos de contacto profesionales públicos
Obra creativa: Contenido del caso y pruebas reveladas
¿Cómo se debe implementar JSON-LD?
Google recomienda el uso de JSON-LD, y también soporta Microdata y RDFa. Next.js permite incluir el script `application/ld+json` en el HTML generado en el servidor. Lo importante no es la diferencia entre la etiqueta `<head>` o `<body>`, sino que los datos puedan ser extraídos, que el JSON sea legible y que se utilice una URL canónica válida. Además, cada campo debe poder ser verificado tanto en el contenido principal de la página como en información relacionada de forma explícita. Se recomienda utilizar un `@id` estable para los recursos compartidos, evitando la creación de múltiples instancias del mismo en la misma página.
Establecer el esquema a partir del contenido de la imagen, en un orden específico.
No es recomendable empezar con un modelo de generador y luego rellenarlo con el texto. Un orden de trabajo más seguro sería:
El objetivo principal de la página de confirmación, así como la correspondencia entre la URL canónica y el contenido visible.
Seleccione el tipo que sea compatible con Google y que se ajuste al contenido principal.
Solo refleja la información existente sobre autores, fechas, imágenes, servicios o casos.
Utiliza la herramienta "Rich Results Test" para verificar la funcionalidad de Google y la herramienta "Schema Markup Validator" para verificar la sintaxis general.
Después de la publicación, utilice la herramienta "Inspeccionar URL" de Google para verificar el HTML que realmente ha obtenido.
Errores comunes
Evitar la inclusión de calificaciones agregadas falsas (como una calificación promedio de 4.9 estrellas sobre 50 reseñas). Esto viola las políticas de Google Rich Results.
El esquema proporcionado no coincide con el contenido real de la página — Google rechazará directamente los resultados enriquecidos.
Aunque no tenga una tienda física, puede mostrar la dirección o el horario de apertura de su negocio local.
En los sitios web comerciales, las secciones de preguntas frecuentes (FAQ), guías y contenido generado por IA se utilizan como atajos para obtener resultados enriquecidos o respuestas basadas en IA.
¿Por qué no se pueden mezclar las preguntas frecuentes, las guías y las funciones de "Speakable"?
Es evidente que las preguntas frecuentes siguen siendo útiles para los usuarios, pero los resultados enriquecidos de Google están principalmente limitados a sitios web gubernamentales y de salud de reconocido prestigio. Los resultados enriquecidos de "HowTo" ya no están disponibles. Los documentos de Google de "Speakable" están diseñados específicamente para contextos de noticias. Esto no significa que los sitios web no puedan utilizar preguntas y respuestas o contenido paso a paso, sino que no deberían comprometerse a obtener resultados enriquecidos o citas de IA simplemente añadiendo etiquetas a su contenido para empresas generales.
El paso de la prueba no garantiza necesariamente que se muestre o se visualice.
La prueba de Resultados Mejorados funciona de la siguiente manera: Google puede decidir si muestra o no los resultados, incluso si el contenido cumple con los requisitos técnicos y algunos criterios, en función del contexto de búsqueda, las políticas de calidad y la relevancia de la página. Si los datos estructurados son engañosos, ocultan contenido o violan las políticas, la página puede perder la capacidad de mostrar resultados mejorados, y en casos graves, Google puede realizar una intervención manual en la consola de búsqueda. Esto no significa que el posicionamiento orgánico inevitablemente disminuya, pero sí que los resultados incorrectos pierden valor.
¿Se castiga si se introduce una estructura incorrecta?
Los datos estructurados que contengan información engañosa o que infrinjan las políticas pueden perder la capacidad de generar resultados enriquecidos, y también pueden ser objeto de intervención manual. Algunos riesgos comunes incluyen la introducción de calificaciones agregadas incorrectas, la inclusión de contenido que los usuarios no pueden ver, y la creación de entidades comerciales o de autores ficticias.
JSON-LD, Microdata y RDFa: ¿cuál elegir?
Google soporta las tres opciones. La recomendación oficial es utilizar JSON-LD: separación del contenido HTML y la estructura, fácil mantenimiento y sin riesgo de afectar el diseño. A menos que ya se esté utilizando Microdata en un sistema existente, es recomendable adoptar JSON-LD directamente en nuevos proyectos.
¿Es necesario que los datos estructurados estén organizados en cada página?
Según el tipo de página: "Organización" y "Sitio Web" pueden compartirse en todo el sitio, las páginas de "Artículo" deben tener la etiqueta "Artículo", las páginas de "Servicio" deben tener la etiqueta "Servicio", y las páginas con jerarquía de navegación deben tener la etiqueta "BreadcrumbList". No se deben aplicar etiquetas a tipos de página que no estén relacionados con el contenido de la página; en este caso, es mejor no etiquetar que etiquetar incorrectamente.