Vuoi bloccare l’intelligenza artificiale? Attenzione a non sparire anche da Google

Circa L'Autore

Da oltre vent'anni Giuseppe Masili opera nel settore Digital. Fondatore di Redomino, affianca aziende e organizzazioni nello sviluppo di progetti digitali con un approccio orientato agli obiettivi e al miglioramento continuo. Nei primi anni della sua carriera ha contribuito alla diffusione in Italia delle piattaforme Open Source Zope e Plone, partecipando come relatore a conferenze nazionali e internazionali e promuovendo una cultura del web aperta e collaborativa. È coautore del libro internazionale The Definitive Guide to Plone (Apress), autore di articoli sul digitale e ha preso parte, come relatore e membro di giuria, a numerose iniziative dedicate all'innovazione, tra cui il Digital Festival e Create24. Nel corso degli anni è stato inoltre intervistato da testate e media specializzati, tra cui Mashable Italia, oltre a podcast e canali dedicati all'innovazione e al futuro del lavoro. Crede nell'approccio agile come metodo per individuare rapidamente il percorso più efficace, adattandolo e migliorandolo in base ai risultati. Ama viaggiare e considera ogni viaggio un'occasione per confrontarsi con culture diverse, osservare nuovi punti di vista e trasformare ogni esperienza in uno stimolo di crescita personale e professionale.

Bloccare l’intelligenza artificiale dal proprio sito può sembrare semplice.

“Non voglio che utilizzi i miei contenuti. La blocco.”

Il problema è che alcuni sistemi automatici utilizzati per leggere il Web possono svolgere più di una funzione.

E dal 15 settembre 2026 una modifica introdotta da Cloudflare rende questa distinzione ancora più importante.

Perché bloccando qualcosa che non vogliamo potremmo rischiare di bloccare anche qualcosa che ci serve.

Prima di tutto: cos’è un crawler?

Quando Google visita automaticamente una pagina per scoprirla e inserirla nel proprio motore di ricerca utilizza un programma chiamato crawler.

Possiamo immaginarlo come un piccolo esploratore automatico che gira continuamente per il Web, legge le pagine e comunica al proprio sistema cosa ha trovato.

Con l’arrivo dell’intelligenza artificiale, però, questi esploratori possono avere obiettivi molto diversi.

Cloudflare ha deciso di distinguerli in tre grandi categorie.

Search: visita il sito per permettere successivamente alle persone di trovarne i contenuti attraverso una ricerca.

Agent: visita una pagina in tempo reale perché una persona ha chiesto a un’intelligenza artificiale di svolgere un’attività.

Training: raccoglie informazioni che possono essere utilizzate per addestrare o migliorare un modello di intelligenza artificiale.

Sembrano differenze tecniche.

In realtà riguardano direttamente chiunque possieda un sito.

Il problema: lo stesso crawler può fare più cose

La situazione si complica quando lo stesso crawler svolge più funzioni.

Cloudflare cita, tra gli esempi, Googlebot, BingBot e Applebot.

Con le nuove regole, quando un crawler appartiene contemporaneamente a categorie differenti può essere applicata la regola più restrittiva.

Ed ecco il rischio.

Un’azienda potrebbe decidere:

“Non voglio che i miei contenuti vengano utilizzati per addestrare l’intelligenza artificiale.”

Una scelta perfettamente legittima.

Ma una configurazione troppo restrittiva potrebbe avere conseguenze anche sull’accesso necessario ad altre funzioni, compresa la ricerca.

In altre parole:

attenzione a non chiudere la porta all’intelligenza artificiale e scoprire di averla chiusa anche a Google.

Bloccare l’AI non è più un semplice sì o no

La vera novità è probabilmente questa.

Fino a poco tempo fa ragionavamo soprattutto così:

Google può leggere il mio sito oppure no?

Adesso dobbiamo iniziare a porci domande più precise.

Voglio che il mio sito venga trovato nei motori di ricerca?

Voglio che ChatGPT o un altro assistente possa consultarlo quando un utente fa una domanda?

Voglio permettere che i miei contenuti vengano utilizzati per addestrare un modello?

Sono tre decisioni differenti.

Ed è importante che le impostazioni tecniche del sito riflettano esattamente ciò che vogliamo ottenere.

Rappresentazione delle regole Cloudflare per gestire l’accesso al sito di Googlebot e dei crawler AI

Il Web sta cambiando anche dietro le quinte

Cloudflare sta facendo qualcosa di apparentemente tecnico, ma il segnale è importante.

Il Web sta iniziando a distinguere non soltanto chi accede a un contenuto, ma anche perché lo sta facendo.

Per chi si occupa di SEO, cioè ottimizzazione per i motori di ricerca, e di visibilità nelle risposte generate dall’intelligenza artificiale, questa distinzione diventerà sempre più importante.

La regola pratica, però, rimane semplicissima.

Prima di bloccare un crawler perché contiene la parola “AI”, controlliamo bene che cosa fa.

Perché proteggere i propri contenuti è legittimo.

Renderli involontariamente invisibili è tutta un’altra storia.

Cosa ne pensi?