Herramienta de diagnóstico

Comprobador de preparación para IA

Los asistentes de IA se están convirtiendo en la portada de la web. Esta comprobación te dice si ChatGPT, Claude, Perplexity y la IA de Google pueden rastrear tu sitio, entenderlo y citarlo: llms.txt, reglas de robots.txt para rastreadores de IA, datos estructurados, sitemap y metadatos, cada punto con su puntuación y su solución.

La comprobación descarga unos pocos archivos públicos (página de inicio, robots.txt, llms.txt, sitemap) a través de nuestro servidor. No se almacena nada.

Qué significa estar «listo para la IA»

Buscar antes era diez enlaces azules; cada vez más es una única respuesta sintetizada por ChatGPT, Claude, Perplexity o los resultados con IA de Google. Esos sistemas solo recomiendan sitios que pueden rastrear, interpretar y en los que confían, y las señales en las que se apoyan no coinciden exactamente con las del SEO clásico.

Importan tres capas. Acceso: tu robots.txt decide qué rastreadores de IA pueden leer el sitio, y bloquear al bot equivocado te borra por completo de sus respuestas. Comprensión: los datos estructurados (JSON-LD) y unos metadatos limpios son lo que los motores de respuestas interpretan con más fiabilidad al decidir de qué tratan tus páginas. Orientación: un archivo llms.txt en la raíz de tu sitio ofrece a los sistemas de IA un mapa curado de lo que importa, en un formato pensado para modelos de lenguaje.

Este comprobador lee exactamente lo que leería un rastreador de IA y puntúa las tres capas, con una solución concreta para cada hallazgo.

Qué se comprueba

  • llms.txt: presente en la raíz del sitio y con formato llmstxt.org válido (título, resumen, secciones con enlaces)
  • robots.txt: reglas de acceso para 11 grandes rastreadores de IA (GPTBot, ClaudeBot, PerplexityBot, Google-Extended y más), explicando el impacto en búsqueda frente a entrenamiento
  • Datos estructurados: bloques JSON-LD en la página de inicio y qué tipos de schema.org declaran
  • Sitemap: detectable mediante robots.txt o en la ubicación predeterminada
  • Metadatos: título, meta descripción, URL canónica, etiquetas Open Graph y H1

¿Aún no tienes llms.txt?

Genera uno válido a partir de tu sitemap en cosa de un minuto, gratis.

Abrir el generador de llms.txt →

Del blog

Todas las guías →

Frequently asked questions

¿Qué es llms.txt?
Un archivo markdown sencillo en la raíz de tu sitio (como robots.txt, pero para modelos de lenguaje) que nombra tu sitio, lo resume y enlaza tus páginas más importantes. Los sistemas de IA que lo admiten lo usan como mapa curado en lugar de adivinar a partir del HTML en bruto. El formato está definido en llmstxt.org.
¿Bloquear a GPTBot perjudica mi posicionamiento en Google?
No. El posicionamiento clásico de Google no tiene en cuenta a GPTBot. Pero bloquear al rastreador de un buscador de IA te elimina de sus respuestas: bloquea a PerplexityBot y Perplexity no podrá citarte; bloquea a GPTBot y la búsqueda de ChatGPT te ignorará. Google-Extended es la excepción: solo controla el entrenamiento de Gemini, no la búsqueda.
¿llms.txt es un estándar oficial?
Es una propuesta de la comunidad (llmstxt.org) con adopción creciente pero desigual. Cuesta un pequeño archivo de texto, varias herramientas de IA ya lo leen y a ninguna le perjudica, lo que lo convierte en un seguro barato más que en una apuesta.
¿En qué se diferencia esto del SEO normal?
El SEO clásico optimiza para algoritmos de posicionamiento; la preparación para IA optimiza para que los motores de respuestas te lean, te entiendan y te citen. Se solapan (sitemaps, datos estructurados, buenos metadatos), pero la preparación para IA añade la política de acceso de rastreadores y el llms.txt, y da menos peso a enlaces y palabras clave.
Mi puntuación es baja. ¿Qué corrijo primero?
Por orden de impacto: desbloquea a los rastreadores de búsqueda con IA que quieres que te citen, añade datos estructurados JSON-LD a tus páginas clave y después añade un llms.txt. Los problemas de metadatos (título, descripción, canónica) son victorias rápidas que normalmente se resuelven en una tarde.