Chi ha un sito, che sia quello di uno studio professionale, di un negozio o un blog personale, prima o poi legge che l’intelligenza artificiale usa i contenuti del web senza chiedere il permesso. La tentazione è chiudere la porta: bloccare ChatGPT e gli altri servizi simili, e non pensarci più.
Chiudere la porta però ha un costo, e non sempre chi lo fa se ne accorge. Le visite che l’intelligenza artificiale fa a un sito non sono tutte uguali: alcune possono portare persone, altre no. E dal 15 settembre, per chi usa Cloudflare, la scelta sbagliata può far sparire il sito anche da Google.
Intelligenza artificiale sul sito web: tre tipi di visite #
Quando si parla di “bot AI” si mettono insieme programmi che fanno lavori diversi. Le aziende che li gestiscono, come OpenAI, Anthropic e Google, li distinguono nella loro documentazione, e per quasi tutti lasciano scegliere.
Il primo tipo legge il sito per poterlo citare. Quando qualcuno chiede a ChatGPT un consiglio, per esempio un commercialista in una certa città, le risposte possono contenere un link ai siti che il servizio conosce. È una visita che somiglia a quella di Google: serve a farsi trovare.
Il secondo tipo raccoglie testi per addestrare i modelli, cioè per insegnare loro a scrivere e a rispondere. Qui il sito non riceve niente in cambio: i contenuti diventano parte di quello che il modello sa, senza un link e senza una visita.
Il terzo tipo è un agente: apre una pagina nel momento in cui una persona fa una domanda al chatbot, per leggerla al suo posto. Cosa possono fare gli agenti, oltre a leggere, l’abbiamo raccontato in cosa può già fare un agente AI.
Bloccare tutto: cosa si perde #
Bloccare tutti i bot AI significa rinunciare anche al primo tipo di visita, quello che porta le citazioni. OpenAI lo scrive in chiaro: i siti che bloccano il bot con cui ChatGPT cerca le risposte non compaiono più nelle risposte di ricerca di ChatGPT, salvo come semplici link di navigazione.
Per un sito che vive di contatti è una perdita concreta. Chi usa ChatGPT per cercare un servizio non può scegliere un sito che nelle risposte non compare, e i concorrenti che non hanno bloccato niente restano visibili.
Rifiutare solo l’addestramento #
Se il dubbio riguarda l’uso dei contenuti per addestrare i modelli, puoi rifiutare solo quello. OpenAI scrive che le due scelte sono indipendenti: un sito può restare nelle risposte di ChatGPT e dire no all’addestramento. Per Google il rifiuto dell’addestramento non cambia la presenza nella Ricerca né il posizionamento. Vale lo stesso per Apple.
C’è un’eccezione da conoscere. Con Google, lo stesso rifiuto impedisce anche di usare il sito per le risposte dell’app Gemini: chi lo sceglie rinuncia anche a quelle.
In pratica il rifiuto si scrive nel robots.txt, un file di testo salvato nella cartella principale del sito e dice ai programmi automatici quali pagine possono leggere. Sono poche righe, che chi gestisce il sito può aggiungere.
AI Overview di Google: una scelta a parte #
I riassunti che Google mostra sopra i risultati, le AI Overview, sono un caso a sé. Rifiutare l’addestramento non toglie un sito da lì. Per decidere se comparire c’è un interruttore in Search Console, lo strumento gratuito di Google per chi gestisce un sito, disponibile per tutti i siti dal 31 agosto 2026.
Di partenza il sito è incluso. Chi lo esclude non riceve più visite né impressioni da quei riassunti, scrive Google, mentre la posizione nei risultati normali non cambia. La guida di Search Console avverte anche che nei riassunti continuano a comparire i contenuti di altri siti, che possono somigliare a quelli esclusi. Per chi cerca clienti, uscire vuol dire lasciare quello spazio ad altri.
Cloudflare: attenzione all’opzione Block #
Cloudflare è un servizio che protegge e velocizza i siti. Secondo il suo rapporto sui bot, attraverso la sua rete passa oltre il 20% del web. Tra le sue impostazioni ce n’è una per decidere cosa fare con i bot AI, anche nel piano gratuito.
Dal 15 settembre 2026 quell’impostazione è cambiata. Google, Apple e Microsoft usano lo stesso programma sia per la ricerca sia per l’intelligenza artificiale, e ora l’opzione Block ferma anche quello. Cloudflare lo scrive senza giri di parole: con Block i programmi di Google, Apple e Microsoft non raggiungono più il sito, ricerca compresa. Per rifiutare l’addestramento restando su Google c’è un’opzione apposita, Disallow AI Training.
Chi aveva già acceso il vecchio blocco dei bot AI non perde Google: Cloudflare lo sposta da solo sulla nuova opzione. Il rischio riguarda chi sceglie adesso, e sceglie Block pensando di fermare solo l’intelligenza artificiale.
Sito web di un’azienda, di un professionista o un blog: cosa conviene #
La risposta cambia con quello che il sito deve fare.
Per il sito di un professionista, di un negozio o di un’azienda, che serve a farsi trovare, conviene lasciar passare i bot che cercano risposte e gli agenti. Puoi rifiutare l’addestramento, sapendo che con Google rinunci anche alle risposte di Gemini.
Chi vive di pubblicità ha un problema diverso: un agente che legge la pagina al posto della persona non vede gli annunci. Per questo Cloudflare, sui siti nuovi che dichiarano pubblicità, propone di bloccare gli agenti su quelle pagine.
Per un blog personale, che non cerca clienti, la scelta è soprattutto di principio: rifiutare l’addestramento costa poco, sparire dalle risposte dipende da quanto interessa essere letti.
Come controllare il tuo sito web #
Il primo controllo si fa da soli, in un minuto: aggiungere /robots.txt all’indirizzo del sito
e aprirlo nel browser. Se compaiono le righe User-agent: * e subito sotto
Disallow: /, il sito chiede ai programmi automatici, di solito compreso quello
di Google, di non leggere le pagine. Se compaiono GPTBot o ClaudeBot con
Disallow: /, il sito rifiuta l’addestramento a OpenAI o ad Anthropic, e non
tocca la ricerca. Se compaiono altri nomi, è il caso di capire cosa rifiutano.
Poi, a chi gestisce il sito, conviene fare tre domande:
- Il sito blocca qualche bot AI, e quale? La risposta va data per tipo: chi cerca risposte, chi addestra, gli agenti.
- Il sito usa Cloudflare, e com’è impostato il controllo sui bot AI? Se la risposta è Block, il sito può essere fuori da Google.
- In Search Console, il sito è incluso nelle AI Overview? È una scelta, e va fatta sapendo cosa comporta.
Il robots.txt, comunque, è una richiesta e non un lucchetto: i programmi lo rispettano per scelta, e Cloudflare stessa ricorda che rispettarlo è volontario. Se queste domande non trovano risposta, scrivimi: farsi trovare da Google e citare dalle AI è il lavoro che faccio su SEO e GEO.
Domande frequenti #
Se blocco ChatGPT, il mio sito web sparisce da Google? #
Dipende da come lo blocchi. Nel robots.txt i programmi di OpenAI e quello di Google sono separati, quindi bloccare ChatGPT non tocca Google. Su Cloudflare invece, dal 15 settembre 2026, l’opzione Block ferma anche il programma di Google, e con il tempo il sito esce dalla ricerca.
Si può impedire all’intelligenza artificiale di usare il mio sito web per addestrarsi, senza sparire dalle ricerche? #
Sì. OpenAI, Google e Apple permettono di rifiutare l’addestramento restando nei risultati di ricerca. Con Google il rifiuto vale anche per le risposte dell’app Gemini basate sulla ricerca. Su Cloudflare l’opzione giusta è Disallow AI Training, non Block.
Come si esce dalle AI Overview di Google? #
Con un interruttore in Search Console, disponibile per tutti i siti dal 31 agosto 2026. Chi esce non riceve più visite né impressioni dalle AI Overview, e la posizione nei risultati normali non cambia. Rifiutare l’addestramento non basta: sono due scelte separate.
Il robots.txt basta a bloccare l’intelligenza artificiale? #
No. È una richiesta che i programmi rispettano per scelta. Le grandi aziende dichiarano di rispettarla, ma alcuni agenti, attivati da una persona, possono non tenerne conto. Per fermare un programma serve un blocco sul server o su servizi come Cloudflare.
Fonti #
Blog di Cloudflare: Disallow AI Training e crawler a scopo misto, 15 settembre 2026, e rapporto sui bot, 1° luglio 2026, aggiornato al 15 luglio 2026. Documentazione di Cloudflare sul robots.txt gestito, aggiornata al 3 agosto 2026.
Documentazione di Google sui crawler comuni, aggiornata al 14 luglio 2026, e sui fetcher attivati dagli utenti, aggiornata al 19 agosto 2026. Guida di Search Console sul Controllo dell’AI generativa nella Ricerca, con nota del 31 agosto 2026, e annuncio di Google del 3 giugno 2026, aggiornato al 31 agosto 2026.
Documentazione dei bot di OpenAI, senza data dichiarata; di Perplexity, aggiornata al 29 gennaio 2026; di Anthropic, aggiornata al 7 aprile 2026; di Apple, pubblicata il 4 settembre 2026.