Bloccare l’intelligenza artificiale dal proprio sito può sembrare semplice.
“Non voglio che utilizzi i miei contenuti. La blocco.”
Il problema è che alcuni sistemi automatici utilizzati per leggere il Web possono svolgere più di una funzione.
E dal 15 settembre 2026 una modifica introdotta da Cloudflare rende questa distinzione ancora più importante.
Perché bloccando qualcosa che non vogliamo potremmo rischiare di bloccare anche qualcosa che ci serve.
Prima di tutto: cos’è un crawler?
Quando Google visita automaticamente una pagina per scoprirla e inserirla nel proprio motore di ricerca utilizza un programma chiamato crawler.
Possiamo immaginarlo come un piccolo esploratore automatico che gira continuamente per il Web, legge le pagine e comunica al proprio sistema cosa ha trovato.
Con l’arrivo dell’intelligenza artificiale, però, questi esploratori possono avere obiettivi molto diversi.
Cloudflare ha deciso di distinguerli in tre grandi categorie.
Search: visita il sito per permettere successivamente alle persone di trovarne i contenuti attraverso una ricerca.
Agent: visita una pagina in tempo reale perché una persona ha chiesto a un’intelligenza artificiale di svolgere un’attività.
Training: raccoglie informazioni che possono essere utilizzate per addestrare o migliorare un modello di intelligenza artificiale.
Sembrano differenze tecniche.
In realtà riguardano direttamente chiunque possieda un sito.
Il problema: lo stesso crawler può fare più cose
La situazione si complica quando lo stesso crawler svolge più funzioni.
Cloudflare cita, tra gli esempi, Googlebot, BingBot e Applebot.
Con le nuove regole, quando un crawler appartiene contemporaneamente a categorie differenti può essere applicata la regola più restrittiva.
Ed ecco il rischio.
Un’azienda potrebbe decidere:
“Non voglio che i miei contenuti vengano utilizzati per addestrare l’intelligenza artificiale.”
Una scelta perfettamente legittima.
Ma una configurazione troppo restrittiva potrebbe avere conseguenze anche sull’accesso necessario ad altre funzioni, compresa la ricerca.
In altre parole:
attenzione a non chiudere la porta all’intelligenza artificiale e scoprire di averla chiusa anche a Google.
Bloccare l’AI non è più un semplice sì o no
La vera novità è probabilmente questa.
Fino a poco tempo fa ragionavamo soprattutto così:
Google può leggere il mio sito oppure no?
Adesso dobbiamo iniziare a porci domande più precise.
Voglio che il mio sito venga trovato nei motori di ricerca?
Voglio che ChatGPT o un altro assistente possa consultarlo quando un utente fa una domanda?
Voglio permettere che i miei contenuti vengano utilizzati per addestrare un modello?
Sono tre decisioni differenti.
Ed è importante che le impostazioni tecniche del sito riflettano esattamente ciò che vogliamo ottenere.

Il Web sta cambiando anche dietro le quinte
Cloudflare sta facendo qualcosa di apparentemente tecnico, ma il segnale è importante.
Il Web sta iniziando a distinguere non soltanto chi accede a un contenuto, ma anche perché lo sta facendo.
Per chi si occupa di SEO, cioè ottimizzazione per i motori di ricerca, e di visibilità nelle risposte generate dall’intelligenza artificiale, questa distinzione diventerà sempre più importante.
La regola pratica, però, rimane semplicissima.
Prima di bloccare un crawler perché contiene la parola “AI”, controlliamo bene che cosa fa.
Perché proteggere i propri contenuti è legittimo.
Renderli involontariamente invisibili è tutta un’altra storia.
