Al contrario
L'IA fuori dal tuo sito.
Google dentro.
Controlliamo quali dei 14 crawler di IA che contano possono leggere il tuo sito oggi, a quali viene solo chiesto di restare fuori e se Google e Bing entrano ancora. Poi ti diamo un piano per chiudere la porta senza toccare il traffico che ti arriva dai motori di ricerca.
- GooglebotGoogle Searchdentro
- BingbotBingdentro
- GPTBotOpenAIfuori
- ClaudeBotAnthropicfuori
- Google-ExtendedGeminifuori
- PerplexityBotPerplexityfuori
- CCBotCommon Crawlfuori
- BytespiderByteDancefuori
Cosa controlliamo
robots.txt, crawler per crawler
I 14 crawler di IA che contano, da quello di OpenAI a quello di Common Crawl, confrontati con il tuo robots.txt così come lo leggono loro.
Se il tuo server li respinge davvero
Bussiamo alla porta come ciascun crawler. Una riga in robots.txt è una richiesta; un 403 dal tuo server è una serratura.
La tua riserva dei diritti
La legge europea ti permette di riservare i tuoi contenuti rispetto all'estrazione di testo e di dati in un formato leggibile dalle macchine, e le aziende di IA sono tenute a rispettarla. Controlliamo se lo fai.
Che Google e Bing entrino ancora
Quasi tutti i modi di bloccare l'IA, fatti male, ti tolgono anche dai motori di ricerca. Controlliamo che non sia il tuo caso.
Il piano, delicato di proposito
19 €19 USD, una volta sola: ogni passo per chiudere la porta, pronto da copiare e nell'ordine che conta. Niente che ti costi traffico dai motori di ricerca, e niente che richieda uno sviluppatore, a meno che tu non voglia anche la serratura sul server.
- Il tuo blocco per robots.txt con i 14 crawler di IA, pronto da incollare
- La riserva dei diritti prevista dalla legge UE, con il tag e il file pronti
- Una clausola per le tue condizioni d'uso
- Come chiudere a chiave la porta sul tuo server o CDN, senza toccare Google
- Cosa non toccare per non perdere traffico dai motori di ricerca
- Un prompt perché la tua IA lo applichi nel tuo codice
Cosa non ti chiederemo di fare
- Bloccare Googlebot o Bingbot, o chiudere fuori tutti i bot con una sola riga.
- Aggiungere noindex o nascondere le tue pagine ai motori di ricerca in qualsiasi altro modo.
- Togliere il tuo testo dai risultati di Google per tenerlo fuori da AI Overviews.
- Nascondere i tuoi contenuti dietro JavaScript o un login per proteggerli.
Cosa nessuno può prometterti
- Quello che un modello ha già imparato resta
- Il blocco funziona da qui in avanti. Il testo raccolto prima è già nei modelli che esistono oggi.
- Alcuni crawler non chiedono il permesso
- Le grandi aziende rispettano robots.txt. Non tutti i bot lo fanno, e OpenAI e Perplexity avvertono che quelli che agiscono per conto di una persona potrebbero non farlo. A questo serve la serratura sul server.
- Le risposte IA di Google usano il crawler di Google
- AI Overviews legge il tuo sito con lo stesso Googlebot della ricerca. Non c'è modo di uscirne senza limitare anche la ricerca, e non ti diremo il contrario.
Domande
Questo mi toglie da Google?
No. Tutto ciò che c'è nel piano riguarda solo i crawler di IA. Google Search e Bing continuano a leggere il tuo sito come prima, e il controllo ti avvisa se qualcosa li sta già bloccando.
Toglie il mio sito da ChatGPT?
Impedisce ai crawler di OpenAI di leggerlo da qui in avanti, e questo ti toglie dalle ricerche di ChatGPT e dall'addestramento futuro. Quello che un modello ha già imparato resta, e il tuo testo può ancora arrivargli attraverso copie pubblicate altrove.
Perché non bloccare tutti i bot e basta?
Perché anche i motori di ricerca sono bot. Un solo «Disallow: /» per tutti chiude la porta all'IA e, insieme, ai visitatori che ti arrivano da Google.
Il controllo è gratis?
Sì, e ti dice esattamente chi entra. Quello che paghi, una volta sola, è il piano: i file e le righe pronti da copiare, la riserva dei diritti, la regola per il server e un prompt per la tua IA.