Validador de sitemaps XML
Comprueba cualquier sitemap XML según el protocolo oficial de sitemaps.org y las reglas de Google. Introduce una URL, sube un archivo o pega el XML y recibe cada error explicado, con su solución.
Los archivos pegados o subidos se comprueban en tu navegador y nunca se suben a ningún servidor. Las comprobaciones por URL descargan el archivo a través de nuestro servidor sin almacenar nada.
Qué se comprueba
- Sintaxis XML correcta (errores con línea y columna)
- Elemento raíz y espacio de nombres de sitemaps.org
- Un <loc> obligatorio en cada entrada, con URLs http(s) absolutas de menos de 2.048 caracteres
- Escapado correcto de &, comillas y ángulos en las URLs
- Los límites de 50.000 URLs y 50 MB sin comprimir
- Fechas <lastmod> en formato W3C, con aviso si están en el futuro
- Valores de <changefreq> y rangos de <priority>
- URLs duplicadas y URLs en un host distinto al del sitemap
- Índices de sitemaps, con validación de cada sitemap hijo en un clic
Errores frecuentes de sitemap y cómo corregirlos
Estos son los fallos que más vemos, con el camino más corto hasta el verde.
| Espacio de nombres incorrecto o ausente | La etiqueta <urlset> debe declarar exactamente xmlns="http://www.sitemaps.org/schemas/sitemap/0.9". Cópialo tal cual: una errata o el antiguo espacio de nombres 0.84 hacen que los analizadores rechacen el archivo entero. |
| Ampersands sin escapar en las URLs | Un & sin escapar rompe el análisis XML. Escribe & en su lugar: /page?a=1&b=2. Lo mismo vale para < > " y '. |
| URLs relativas o mal formadas | Cada <loc> debe ser una URL absoluta completa con su esquema, como https://example.com/page/. Las rutas relativas del tipo /page/ no son válidas. |
| Fechas lastmod inválidas | Usa el formato de fecha W3C: 2026-07-16 o 2026-07-16T09:30:00+00:00. Formatos como 16/07/2026 o marcas de tiempo Unix no son válidos, y las fechas en el futuro se ignoran. |
| Más de 50.000 URLs o 50 MB | Divide el sitemap en varios archivos y lístalos en un índice de sitemaps. La mayoría de los generadores lo hacen automáticamente al superar el límite. |
| El sitemap devuelve un error o HTML | La URL del sitemap debe responder HTTP 200 con contenido XML. Un 404, una cadena de redirecciones hacia una página de error o una página HTML disfrazada de sitemap.xml son fallos muy habituales. |
| URLs en el host equivocado | Las URLs de un sitemap deben vivir en el mismo host que sirve el sitemap, incluida la misma variante con o sin www y el mismo esquema (https). |
| Bloqueado por robots.txt | Si robots.txt prohíbe las URLs que lista tu sitemap, los rastreadores reciben señales contradictorias. Alinea ambos: el sitemap solo debe listar páginas que quieres que se rastreen. |
Del blog
robots.txt para rastreadores de IA: recetas listas
Tres recetas y una tabla bot por bot para controlar GPTBot, ClaudeBot, PerplexityBot y los demás desde un pequeño archivo de texto.
sitemapsErrores comunes en sitemaps XML y cómo corregirlos
Del espacio de nombres equivocado al «No se ha podido obtener» de Search Console: cada error habitual de sitemap con su síntoma, su causa y su arreglo.
sitemapsSitemaps XML: qué incluir y cómo mantenerlos
Un buen sitemap es estricto: solo URLs canónicas e indexables con estado 200, fechas veraces y un mantenimiento que no dependa de la memoria de nadie.