AIVIS

Report sul blocco dei crawler AI 2026

Quali crawler AI tengono fuori i siti, e quali lasciano entrare? Misurato su 1349 robots.txt reali, non con un sondaggio.

Campione: 1349 file robots.txt, su 1769 domini scansionati · Scansioni dal 19 set 2026 al 22 set 2026 · Ricalcolato il 25 set 2026

11,4%Bloccano almeno un crawler AI
7,6%Bloccano GPTBot
1,4%Bloccano tutti i 13 crawler AI
1349robots.txt analizzati

Dei 1349 robots.txt analizzati da AIVIS, l’11,4% esclude almeno un crawler AI dall’intero sito, e l’1,4% li esclude tutti e 13. La grande maggioranza lascia ogni crawler AI libero di leggere.

Il blocco colpisce l’addestramento dei modelli molto più delle risposte: l’11,4% dei siti blocca almeno un crawler di training, mentre solo il 5,8% blocca un crawler di ricerca AI e il 5,6% i fetcher che un assistente invia quando un utente gli chiede di aprire una pagina. Blocca soltanto i crawler di training il 5,1% dei siti, lasciando aperte la ricerca AI e le visite su richiesta.

Fra i settori con abbastanza domini da essere rappresentativi, Notizie e media è quello che blocca più spesso (il 50,9% dei robots.txt esclude almeno un crawler AI) e Università quello che blocca meno (lo 0%).

Tasso di blocco per crawler

Quota dei 1349 robots.txt che vietano l’intero sito a ciascun crawler.

Crawler (user-agent)GestoreScopoBloccato da
CCBotCommon CrawlAddestramento modelli8,9%
BytespiderByteDanceAddestramento modelli8,6%
GPTBotOpenAIAddestramento modelli7,6%
ClaudeBotAnthropicAddestramento modelli7,3%
Google-ExtendedGoogleAddestramento modelli6,7%
anthropic-aiAnthropicAddestramento modelli6,6%
Applebot-ExtendedAppleAddestramento modelli6,6%
Meta-ExternalAgentMetaAddestramento modelli6,5%
PerplexityBotPerplexityIndice di ricerca AI5,6%
ChatGPT-UserOpenAIVisita su richiesta dell’utente4,1%
Perplexity-UserPerplexityVisita su richiesta dell’utente3,9%
Claude-UserAnthropicVisita su richiesta dell’utente3,6%
OAI-SearchBotOpenAIIndice di ricerca AI3%

Blocco dei crawler AI per settore

Quota di robots.txt di ogni settore che blocca almeno un crawler AI, e i quattro crawler su cui si chiede di più.

Settorerobots.txtAlmeno un crawler AIGPTBotClaudeBotPerplexityBotGoogle-Extended
Tutti i siti134911,4%7,6%7,3%5,6%6,7%
SaaS e software1197,6%0,8%0,8%0%0,8%
Notizie e media5750,9%38,6%35,1%31,6%33,3%
Università460%0%0%0%0%
E-commerce3611,1%8,3%5,6%0%8,3%
Banche e finanza2516%8%4%4%8%
Pubblica amministrazione238,7%8,7%4,3%8,7%4,3%
Hotel e B&B128,3%8,3%8,3%0%8,3%
Automotive1020%20%20%10%20%
Telco e utility(campione ridotto)80%0%0%0%0%
Ristoranti(campione ridotto)850%25%37,5%25%37,5%
Viaggi e trasporti(campione ridotto)633,3%0%0%0%0%
Agenzie immobiliari(campione ridotto)616,7%16,7%0%0%0%
Agenzie web(campione ridotto)40%0%0%0%0%
Studi legali e professionisti(campione ridotto)20%0%0%0%0%
Artigiani e attività locali(campione ridotto)20%0%0%0%0%

Il settore è assegnato dal classificatore di AIVIS in base al contenuto della homepage: ce l’hanno 390 dei 1769 domini, gli altri contano nei totali ma non in questa tabella. I settori con meno di 10 robots.txt sono in grigio e marcati low_sample nel dataset: troppo pochi per rappresentare il settore.

Metodologia

Scarica il dataset

Totali, il tasso di ogni crawler e ogni riga di settore dietro questo report, ricalcolati dal vivo man mano che il corpus cresce.

Licenza CC-BY 4.0 — riutilizzabile liberamente citando AIVIS.

Citare come: AIVIS, AI Crawler Blocking Report 2026, https://aivis.lumnika.com/en/research/ai-crawler-blocking-2026

Il tuo sito blocca i crawler AI che ti servono?

Controlla gratis in pochi secondi il tuo robots.txt contro tutti i 13 crawler AI e scopri quale regola esclude ciascuno.