Mira tu página como la leen ChatGPT, Claude y Perplexity
LLM Inspect es la inspección de URL de Search Console, pero para la IA. Te dice si tu página ya aparece citada en las respuestas que monitorizas y qué recibe un sistema de IA cuando la lee: si los bots pueden entrar, qué ven sin JavaScript, qué texto extraen y cómo lo trocean.
LLM Inspect
tudominio.com/guia-suelos-garaje
72/100
Sin JavaScript solo se ve el 64 % del contenido
main#contenido se pinta con JavaScript: sirve ese texto en el HTML del servidor.
Que Google te indexe no significa que la IA te lea.
Los rastreadores de OpenAI, Anthropic y Perplexity no ejecutan JavaScript, se topan con desafíos anti-bot y se quedan con un extracto del texto. Si eso falla, tu página no entra en la respuesta, por buena que sea.
Lo que suele pasar sin que nadie lo vea
- •El contenido se pinta con JavaScript y GPTBot, ClaudeBot y PerplexityBot reciben una página casi vacía.
- •Un WAF o Cloudflare devuelve un desafío a los bots de IA y nadie se entera.
- •El extractor se lleva el menú, el aviso de cookies o un «[object Object]» en lugar del contenido.
Lo que hace LLM Inspect
- Pide la página con el user-agent de cada bot y la renderiza con Chromium para comparar lo que llega con y sin JavaScript.
- Te enseña el texto exacto que recibe el modelo, con el ruido y los artefactos marcados, y cómo se trocea.
- Prioriza los arreglos con el selector CSS del elemento y cruza la URL con tus citas reales en ChatGPT, Gemini, Perplexity y Claude.
Cómo funciona
Una simulación con herramientas abiertas, explicable de principio a fin.
Tu URL
Cualquier página pública. Las direcciones privadas o internas se rechazan antes de pedir nada.
Acceso y HTML del servidor
robots.txt y una petición con el user-agent de cada bot: código HTTP, redirecciones, desafíos y directivas meta robots y X-Robots-Tag.
Render y extracción
Chromium pinta la página; trafilatura y Readability extraen el texto con y sin JavaScript; axe-core revisa lo que usaría un agente.
Semáforo y resumen
Estado por bloque, estado general con puertas, nota orientativa 0–100 y un resumen con las tres prioridades.
Seis bloques, cada uno con su semáforo
Bien, aviso o crítico, con hallazgos accionables y el selector del elemento cuando lo hay.
Acceso por bot
- robots.txt para GPTBot, OAI-SearchBot, ChatGPT-User, ClaudeBot, Claude-User, Claude-SearchBot, PerplexityBot, Perplexity-User y Google-Extended
- Código HTTP, redirecciones y páginas de desafío por user-agent
- meta robots y X-Robots-Tag (noindex, nosnippet…)
Sin JavaScript
- Cobertura: palabras del contenido principal en el HTML del servidor frente al renderizado
- ≥ 90 % bien, 60–90 % aviso, < 60 % crítico
- Encabezados, enlaces y tablas que solo existen con JavaScript
Lo que recibe el modelo
- El Markdown de trafilatura y el de Readability
- Si se conservan el H1, los encabezados y las tablas
- Ruido colado y artefactos como [object Object], undefined o «Cargando…»: cualquier artefacto es crítico
Fragmentos
- Troceo por H2 y H3 con un tope de unos 800 tokens, como un pipeline RAG
- Avisos de fragmentos de más de 1.000 tokens, de menos de 40 o sin encabezado
- Fragmentos que empiezan con referencias al contexto («como vimos», «esto»…)
Estructura HTML
- Número de H1 y si está dentro de main o article; saltos de nivel
- main, IDs duplicados, tablas sin th, alt, lang y time[datetime]
- Anidamiento inválido y navegación con botones en lugar de enlaces
Preparada para agentes
- Nueve reglas de axe-core: button-name, link-name, label, landmark-unique, image-alt…
- div y span con eventos de clic que no son controles reales
- Snapshot del árbol de accesibilidad: regiones y controles
Sin nota mágica: puertas que no se pueden saltar
Una página que los bots no pueden leer no se arregla con un buen H1. Por eso el estado general sigue dos reglas antes que cualquier media.
Puerta de acceso
CríticoSi un bot de búsqueda no puede entrar (robots.txt, error HTTP, desafío o noindex), el estado general es crítico.
Puerta sin JavaScript
CríticoSi menos del 60 % del contenido llega sin JavaScript, el estado general es crítico aunque el resto esté bien.
La nota orientativa 0–100 pondera acceso (25), sin JavaScript (25), extracción (25), fragmentos y estructura (15) y agentes (10). Siempre va detrás de las puertas: con una activa no pasa de 40.
Es una simulación con herramientas abiertas (httpx, trafilatura, Readability, Chromium y axe-core), no el pipeline interno de OpenAI, Anthropic o Google. Se reproduce el user-agent de cada bot; los bloqueos por la IP verificada del bot real no se pueden simular.
Todo lo que recibes en cada inspección
Un diagnóstico y, sobre todo, qué arreglar primero.
URL en la IA (datos reales)
Citas de la URL en las respuestas que ya monitoriza tu LLM Tracker: motores, prompts, última fecha y fuente de cada dato.
Estado general y chips por lector
Un semáforo general y uno por GPTBot, ClaudeBot, PerplexityBot y agentes.
Vista IA
El Markdown que recibe el modelo, con el ruido resaltado. Alterna entre trafilatura y Readability.
Cobertura sin JavaScript
Qué parte del contenido llega en el HTML del servidor y qué solo aparece con JavaScript.
Fragmentos
Cada fragmento con su título, sus tokens y sus primeras líneas, y los que conviene reescribir.
Arreglos con selector
Cada hallazgo con el selector CSS del elemento y el arreglo sugerido.
Resumen con prioridades
Un resumen en lenguaje natural con las tres acciones de más impacto.
Historial y comparación
Cada inspección queda guardada por URL y se compara con la anterior: qué se ha resuelto y qué es nuevo.
Export PDF y HTML del servidor
Informe en PDF para compartir y el HTML que devolvió el servidor, descargable durante 30 días.
Preguntas frecuentes
¿Tu página está lista para que la citen las IAs?
Empieza con el plan Starter (50 créditos por €49/mes). Cada inspección de LLM Inspect cuesta 1 crédito.
¿Quieres saber también cómo te citan frente a tu competencia? Ampliaciones GEO cruza tu página con las fuentes que citan ChatGPT, Gemini, Perplexity y Claude. Conocer Ampliaciones GEO