¿Puede la IA ver
tu sitio web?
La gente pide recomendaciones a ChatGPT, Claude y Perplexity cada día. Escribe tu dirección web y ve - rastreador por rastreador - si los asistentes de IA tienen permitido entrar. Obtenemos tu página de forma segura - nada más sale de tu navegador.
Escribe tu dirección. Recibe el veredicto.
O pega robots.txt y HTML manualmente
Veredictos de rastreadores de IA
| Rastreador | Qué alimenta | Veredicto | Regla decisiva / arreglo |
|---|
Comprobaciones de la página de inicio
Los sitios Yetty dan la bienvenida a los rastreadores de IA por defecto, sirven llms.txt y datos estructurados automáticamente, y te dan un bloqueo de un solo interruptor si alguna vez cambias de opinión.
Los rastreadores tras
cada respuesta de IA
OpenAI / ChatGPT
GPTBot recopila datos de entrenamiento, OAI-SearchBot construye la búsqueda de ChatGPT, ChatGPT-User visita en vivo cuando un usuario pregunta por ti.
Anthropic / Claude
ClaudeBot rastrea, Claude-SearchBot indexa para búsqueda, Claude-User obtiene páginas durante una conversación en vivo.
Perplexity
PerplexityBot construye el índice de respuestas; Perplexity-User obtiene tu página en vivo cuando te cita.
Google-Extended
No es un rastreador propio - un interruptor de robots.txt que decide si Google puede usar tu contenido en Gemini.
Los bots de conjuntos de datos
CCBot (Common Crawl) alimenta conjuntos de datos con los que se entrenan muchos modelos de IA; Bytespider es de ByteDance; meta-externalagent es de Meta.
Applebot-Extended
El interruptor de Apple para el entrenamiento de Apple Intelligence - la misma idea que Google-Extended.
La gente también pregunta
¿Cómo sé si ChatGPT puede ver mi sitio web?
Revisa tu robots.txt en busca de los rastreadores que usa OpenAI: GPTBot, OAI-SearchBot y ChatGPT-User. Si una regla Disallow los bloquea (o bloquea a todos con un Disallow y barra bajo User-agent asterisco), ChatGPT no puede leer tus páginas. Introduce tu dirección web en este verificador (o pega tu robots.txt) y obtienes un veredicto por rastreador con la regla exacta que lo decide.
¿Debo bloquear rastreadores de IA como GPTBot?
Depende de tu objetivo. Si vendes el contenido en sí, bloquear los rastreadores de entrenamiento puede tener sentido. Pero para la mayoría de los negocios, los asistentes de IA son una fuente creciente de clientes: cuando ChatGPT o Perplexity te recomienda, ese tráfico es gratis. Bloquear los rastreadores de IA significa que simplemente no existes en esas respuestas.
¿Afecta robots.txt a las respuestas de ChatGPT y Perplexity?
Sí. OpenAI, Anthropic y Perplexity afirman todas que sus rastreadores respetan robots.txt. Si tu archivo bloquea sus bots, tus páginas no pueden obtenerse para respuestas de navegación ni índices de búsqueda, así que citan a la competencia en vez de a ti. Google-Extended controla de forma similar si Google puede usar tu contenido para Gemini.
Más herramientas gratuitas:
probador de robots.txt ·
generador de llms.txt ·
Todas las herramientas gratuitas
¿Quieres toda la capa automática? Ve el SEO en piloto automático