Mapas del sitio XML: Dar a los rastreadores un mapa limpio de tu sitio
Un mapa del sitio es una ayuda de descubrimiento más que un palanca de clasificación. Cómo mantener el tuyo descubrible y honesto, y qué URLs nunca deben aparecer en él.
Un mapa del sitio es una ayuda de descubrimiento. Indica a los motores de búsqueda qué URLs consideras dignas de rastrear y aproximadamente cuándo cambió cada una por última vez. En un sitio pequeño con enlaces internos limpios cambia poco. En un sitio grande, nuevo o uno donde las páginas útiles están a 4 clics de la página de inicio, a menudo es la diferencia entre que una página se encuentre esta semana y la próxima cuatrimestre. Dos propiedades hacen que un mapa del sitio sea útil: es descubrible y es honesto. Descubrible significa que está referenciado desde robots.txt o enviado directamente, y vive en un URL estable. Honesto significa que cada URL en él es uno que querrías indexar, es decir, canónico, que devuelva 200 y esté abierto al rastreo. El defecto más común es un mapa del sitio generado una vez y nunca regenerado, que lista URLs que ahora redirigen o 404 mientras omite todo lo publicado desde entonces. El segundo es un mapa del sitio que contiene cada URL que el CMS puede producir, incluidos archivos de etiqueta, duplicados paginados y variantes parametrizadas. Ambos enseñan a los motores de búsqueda a confiar menos en el archivo. Estas comprobaciones confirman que el mapa del sitio se puede encontrar, se analiza como XML válido y usa la estructura de índice y hijo correctamente. Después leen cada URL que lista frente a tus propias directivas, porque un archivo que nombra URLs bloqueadas, noindexadas o no canónicas se contradice a sí mismo, y los motores de búsqueda resuelven esa contradicción confiando menos en él.
Sitemap no encontrado
Por qué importa
Un mapa del sitio ayuda a los motores de búsqueda a encontrar sus páginas importantes más rápido y de manera más consistente.
Cómo lo revisamos
El sitemap se verificó para presencia mediante referencia de robots.txt o ubicación conocida.
Cómo arreglarlo
Conecta tu mapa del sitio XML desde robots.txt con una directiva Sitemap y el mapa del sitio absoluto URL, o envíalo directamente a Google Search Console. Incluye las URLs canónicas que deseas que los sistemas de búsqueda consideren; un mapa del sitio facilita el descubrimiento pero no garantiza que cada URL listado sea rastreado o mostrado.
XML del sitemap inválido
Cómo lo revisamos
El sitemap completo se analizó como XML y se verificaron el espacio de nombres y la estructura del protocolo, los valores loc absolutos del mismo sitio y las fechas lastmod W3C válidas o fechas y horas con zona horaria.
Cómo arreglarlo
Corrija los errores de campo del sitemap XML indicados en la evidencia. Asegúrese de que el documento esté completo, use el espacio de nombres y la estructura del protocolo, contenga valores loc absolutos del mismo sitio y use fechas lastmod W3C válidas o fechas y horas con zona horaria.
robots.txt declara un sitemap en otro sitio web
Por qué importa
Los rastreadores que siguen esta declaración gastan el presupuesto de rastreo del sitio en páginas de otro dominio, normalmente un resto de una migración inacabada.
Cómo lo revisamos
Cada línea Sitemap: de robots.txt se comparó con el dominio que sirve el archivo.
Cómo arreglarlo
Aloje el sitemap en el dominio que describe y actualice la línea Sitemap: de robots.txt. Una declaración fuera del dominio suele indicar una migración a medias o un robots.txt servido por el sitio equivocado.
URL del sitemap tiene noindex
Por qué importa
Un noindex accidental o un bloqueo de robots elimina páginas de los resultados de búsqueda sin ningún error visible en el sitio.
Cómo lo revisamos
Se revisaron las URLs del sitemap para detectar directivas noindex.
Cómo arreglarlo
Elimine noindex de las páginas listadas en su sitemap, o elimínelas del sitemap. Por qué importa: Las URLs de sitemap con noindex crean una contradicción directa que desperdicia presupuesto de rastreo y señala mantenimiento deficiente del sitio a los motores de búsqueda.
URL del sitemap bloqueada en robots.txt
Cómo lo revisamos
Se revisaron las URLs del sitemap contra reglas Disallow de robots.txt.
Cómo arreglarlo
Elimine las reglas Disallow de robots.txt para páginas listadas en su sitemap. Por qué importa: Bloquear URLs de sitemap en robots.txt crea una contradicción: los motores de búsqueda ven que recomienda páginas que simultáneamente les prohíbe acceder, lo que erosiona la confianza en su sitemap.
URL del sitemap no canónica
Por qué importa
Un sitemap con URL no canónicas envía a los motores de búsqueda instrucciones contradictorias sobre cuál versión de una página es la real.
Cómo lo revisamos
Se revisaron las URLs del sitemap para confirmar consistencia canónica.
Cómo arreglarlo
Corrija las URLs del sitemap que apuntan a páginas no canónicas. El sitemap debe listar URLs canónicas. Por qué importa: Las URLs no canónicas en sitemaps dividen el presupuesto de rastreo entre duplicados y pueden hacer que los motores de búsqueda indexen la versión incorrecta de su contenido.
Ver cómo se clasifica tu sitio
Get a free IA-powered SEO report with actionable findings and priority fixes for your website.
Sin registro obligatorio.