Al revés

Que la IA no lea tu web.
Y que Google sí.

Comprobamos cuáles de los 14 rastreadores de IA que importan pueden leer tu web hoy, a cuáles solo se les pide que no entren y si Google y Bing siguen entrando. Después te damos un plan para cerrar la puerta sin tocar tus visitas del buscador.

Sin registro ni tarjeta · Resultado en segundos · Google y Bing también comprobados

  • GooglebotGoogle Searchse queda
  • BingbotBingse queda
  • GPTBotOpenAIfuera
  • ClaudeBotAnthropicfuera
  • Google-ExtendedGeminifuera
  • PerplexityBotPerplexityfuera
  • CCBotCommon Crawlfuera
  • BytespiderByteDancefuera
Fig. 1 La misma puerta, dos clases de visita. Los buscadores siguen entrando; los rastreadores de IA se quedan fuera. Ese es todo el plan.

Qué miramos

  1. robots.txt, rastreador a rastreador

    Los 14 rastreadores de IA que importan, del de OpenAI al de Common Crawl, leídos contra tu robots.txt como lo leen ellos.

  2. Si tu servidor los echa de verdad

    Llamamos a la puerta como cada rastreador. Una línea en robots.txt es una petición; un 403 de tu servidor es un cerrojo.

  3. Tu reserva de derechos

    La ley europea te deja reservar tu contenido frente a la minería de textos y datos de forma legible por máquina, y las empresas de IA tienen que respetarlo. Miramos si lo haces.

  4. Que Google y Bing sigan entrando

    Casi todas las formas de bloquear a la IA, hechas mal, te sacan también del buscador. Comprobamos que no sea tu caso.

El plan, suave a propósito

19 €19 US$, una vez: cada paso para cerrar la puerta, listo para copiar y en el orden que importa. Nada que te cueste visitas del buscador, y nada que necesite un programador salvo que quieras también el cerrojo del servidor.

  • Tu bloque de robots.txt con los 14 rastreadores de IA, listo para pegar
  • La reserva de derechos europea, con la etiqueta y el archivo listos
  • Una cláusula para tus condiciones
  • Cómo echar el cerrojo en tu servidor o CDN sin tocar Google
  • Lo que no hay que tocar para no perder visitas del buscador
  • Un prompt para que tu IA lo aplique en tu código
Ver quién entra

Lo que no te vamos a pedir

  • Bloquear a Googlebot o a Bingbot, o echar a todos los bots con una sola línea.
  • Poner noindex o esconder tus páginas del buscador de cualquier otra forma.
  • Quitar tu texto de los resultados de Google para que no salga en AI Overviews.
  • Esconder tu contenido detrás de JavaScript o de un inicio de sesión para protegerlo.

Lo que nadie te puede prometer

Lo que un modelo ya aprendió, se queda
El bloqueo funciona de aquí en adelante. Lo que se recogió antes ya está en modelos que existen hoy.
Hay rastreadores que no piden permiso
Las empresas grandes respetan robots.txt. No todos los bots lo hacen, y OpenAI y Perplexity avisan de que los que actúan en nombre de una persona pueden no hacerlo. Para eso está el cerrojo del servidor.
Las respuestas de IA de Google usan el rastreador de Google
AI Overviews lee tu web con el mismo Googlebot que el buscador. No hay forma de salir de uno sin limitar el otro, y no te vamos a decir que la hay.

Preguntas

  1. ¿Esto me saca de Google?

    No. Todo lo que hay en el plan nombra solo a rastreadores de IA. Google y Bing siguen leyendo tu web como hasta ahora, y la comprobación te avisa si algo ya los está bloqueando.

  2. ¿Me saca de ChatGPT?

    Impide que los rastreadores de OpenAI la lean de aquí en adelante, lo que te saca de las búsquedas de ChatGPT y del entrenamiento futuro. Lo que un modelo ya aprendió se queda, y tu texto puede seguir llegándole por copias en otros sitios.

  3. ¿Por qué no bloquear a todos los bots y ya está?

    Porque los buscadores también son bots. Un solo «Disallow: /» para todos cierra la puerta a la IA y, a la vez, a tus visitas de Google.

  4. ¿La comprobación es gratis?

    Sí, y te dice exactamente quién entra. Lo que se paga, una vez, es el plan: los archivos y las líneas listos para copiar, la reserva de derechos, la regla del servidor y un prompt para tu IA.

¿Prefieres que la IA te lea? La otra comprobación está aquí