Comprobador de preparación para IA
Los asistentes de IA se están convirtiendo en la portada de la web. Esta comprobación te dice si ChatGPT, Claude, Perplexity y la IA de Google pueden rastrear tu sitio, entenderlo y citarlo: llms.txt, reglas de robots.txt para rastreadores de IA, datos estructurados, sitemap y metadatos, cada punto con su puntuación y su solución.
La comprobación descarga unos pocos archivos públicos (página de inicio, robots.txt, llms.txt, sitemap) a través de nuestro servidor. No se almacena nada.
Qué significa estar «listo para la IA»
Buscar antes era diez enlaces azules; cada vez más es una única respuesta sintetizada por ChatGPT, Claude, Perplexity o los resultados con IA de Google. Esos sistemas solo recomiendan sitios que pueden rastrear, interpretar y en los que confían, y las señales en las que se apoyan no coinciden exactamente con las del SEO clásico.
Importan tres capas. Acceso: tu robots.txt decide qué rastreadores de IA pueden leer el sitio, y bloquear al bot equivocado te borra por completo de sus respuestas. Comprensión: los datos estructurados (JSON-LD) y unos metadatos limpios son lo que los motores de respuestas interpretan con más fiabilidad al decidir de qué tratan tus páginas. Orientación: un archivo llms.txt en la raíz de tu sitio ofrece a los sistemas de IA un mapa curado de lo que importa, en un formato pensado para modelos de lenguaje.
Este comprobador lee exactamente lo que leería un rastreador de IA y puntúa las tres capas, con una solución concreta para cada hallazgo.
Qué se comprueba
- llms.txt: presente en la raíz del sitio y con formato llmstxt.org válido (título, resumen, secciones con enlaces)
- robots.txt: reglas de acceso para 11 grandes rastreadores de IA (GPTBot, ClaudeBot, PerplexityBot, Google-Extended y más), explicando el impacto en búsqueda frente a entrenamiento
- Datos estructurados: bloques JSON-LD en la página de inicio y qué tipos de schema.org declaran
- Sitemap: detectable mediante robots.txt o en la ubicación predeterminada
- Metadatos: título, meta descripción, URL canónica, etiquetas Open Graph y H1
¿Aún no tienes llms.txt?
Genera uno válido a partir de tu sitemap en cosa de un minuto, gratis.
Abrir el generador de llms.txt →Del blog
robots.txt para rastreadores de IA: recetas listas
Tres recetas y una tabla bot por bot para controlar GPTBot, ClaudeBot, PerplexityBot y los demás desde un pequeño archivo de texto.
sitemapsErrores comunes en sitemaps XML y cómo corregirlos
Del espacio de nombres equivocado al «No se ha podido obtener» de Search Console: cada error habitual de sitemap con su síntoma, su causa y su arreglo.
sitemapsSitemaps XML: qué incluir y cómo mantenerlos
Un buen sitemap es estricto: solo URLs canónicas e indexables con estado 200, fechas veraces y un mantenimiento que no dependa de la memoria de nadie.