Agosto 2026 mette a dura prova chi gestisce la visibilità organica di un sito. Da un lato, Google ha avviato il suo terzo spam update dell'anno, con impatto globale su tutte le lingue. Dall'altro, emerge un problema strutturale che va oltre Google: i crawler AI — in particolare quello di ChatGPT — accedono ai contenuti dei siti anche quando robots.txt lo vieta esplicitamente, e lo fanno seguendo una logica di pre-selezione dei brand che cambia le regole della visibilità online. Due fenomeni distinti, ma con un denominatore comune: il controllo del traffico e della reputazione digitale non appartiene più solo alla SEO tradizionale.
Il terzo spam update del 2026: cosa sappiamo
Google ha annunciato il rilascio dell'agosto 2026 spam update il 18 agosto, comunicando che il rollout dovrebbe completarsi in pochi giorni. Si tratta del terzo aggiornamento anti-spam dell'anno, con portata globale e impatto su tutte le lingue.
Secondo Google, l'update colpisce esclusivamente i siti che praticano spam. Tuttavia, come accade con ogni aggiornamento algoritmico, esiste il rischio di collateral damage: siti non intenzionalmente spam possono subire cali di visibilità temporanei o permanenti se presentano segnali ambigui.
Cosa considerare come segnali a rischio:
- Contenuti generati in massa senza valore editoriale reale
- Link schemes o profili backlink artificiali
- Pagine thin content ottimizzate solo per keyword senza rispondere a un intento utente preciso
- Cloaking o redirect ingannevoli
- UGC (user generated content) non moderato con link spam nei commenti o forum
Per le PMI italiane che gestiscono siti e-commerce o portali B2B, il rischio maggiore non è essere siti spam dichiarati, ma avere sezioni del sito — come blog generati con AI non revisionata, pagine categoria duplicate o landing page clonate — che l'algoritmo interpreta come spam segnaletico.
ChatGPT ignora robots.txt: il problema è strutturale
Il fetch bot di ChatGPT raggiunge siti che lo hanno esplicitamente escluso tramite robots.txt. OpenAI stessa, nella propria documentazione, spiega perché il file potrebbe non essere sufficiente a bloccarlo.
Questo non è un bug: è una scelta architetturale che ha implicazioni legali, di privacy e di proprietà intellettuale ancora da definire nel contesto normativo europeo, incluso il GDPR e l'AI Act.
Implicazioni operative immediate:
- Robots.txt non è più uno strumento di controllo sufficiente per i crawler AI di nuova generazione. Chi gestisce contenuti proprietari, cataloghi prodotto riservati o documentazione tecnica deve valutare misure aggiuntive (autenticazione, header HTTP, rate limiting).
- Il monitoraggio dei log di accesso diventa essenziale: identificare quali bot effettivamente accedono al sito, con quale frequenza e su quali URL, permette di prendere decisioni informate.
- Cloudflare e strumenti simili possono offrire un livello di controllo aggiuntivo, ma è importante comprendere che chi misura il traffico bot e vende la soluzione per gestirlo è lo stesso soggetto — un conflitto di interesse da tenere a mente nella valutazione delle soluzioni.
Secondo i dati citati da Cloudflare, il traffico machine potrebbe raggiungere livelli enormemente superiori al traffico umano nei prossimi anni. Il dato esatto non è verificabile in modo indipendente, ma la direzione del trend è confermata dall'esperienza operativa di chi monitora i log server.
ChatGPT pre-seleziona i brand prima di cercare: cosa significa per il GEO
ChatGPT non è neutro nel momento in cui formula le proprie query di ricerca interna. Secondo dati emersi dall'analisi del comportamento del sistema, il modello include già il nome di brand specifici nelle query che genera prima ancora di recuperare contenuti dal web.
Essere inclusi in quella pre-selezione ha un valore di visibilità enormemente superiore rispetto a comparire solo nei risultati di una ricerca successiva. La fonte cita un rapporto di 33x tra le due condizioni — dato che riportiamo fedelmente dalla fonte senza poterne verificare la metodologia.
Cosa significa per brand e aziende italiane:
- La visibilità nei sistemi AI non dipende solo dall'ottimizzazione dei contenuti on-page, ma dalla reputazione digitale complessiva del brand: menzioni autorevoli, presenza editoriale, segnali di autorità tematica.
- Un brand non citato nelle fonti che i modelli AI hanno utilizzato in training e nelle loro fonti di aggiornamento è invisibile per design, non per colpa di un singolo errore tecnico.
- Questo introduce la distinzione tra SEO classica (ottimizzare per i motori di ricerca tradizionali) e GEO — Generative Engine Optimization (costruire autorevolezza tale da essere inclusi nella conoscenza dei modelli AI).
Azioni concrete:
- Presidiare le fonti che i modelli AI tendono a citare: Wikipedia, siti di settore autorevoli, media verticali italiani riconosciuti
- Costruire contenuti strutturati che rispondano a domande specifiche in modo diretto e citabile
- Monitorare le risposte dei principali LLM alle query rilevanti per il proprio settore, verificando se e come il brand viene menzionato
Il watermark AI di Anthropic: rilevanza per i contenuti SEO
Anthropic ha reso pubblici dettagli sul proprio sistema di watermarking per i contenuti generati da AI, incluse le modalità con cui può essere aggirato. La notizia ha implicazioni indirette per chi usa contenuti AI nella propria strategia SEO.
Google ha dichiarato in più occasioni che non penalizza i contenuti AI in quanto tali, ma i contenuti AI di bassa qualità o spam. Tuttavia, se i sistemi di rilevamento AI migliorano — e il dibattito sul watermarking ne è la spia — il rischio che i motori di ricerca sviluppino segnali più sofisticati di identificazione aumenta nel tempo.
Posizione operativa consigliata: usare l'AI come strumento di accelerazione editoriale, non come sostituto del processo editoriale. La revisione umana, l'aggiunta di expertise settoriale verificabile e la citazione di fonti primarie rimangono i differenziatori che nessun watermark può erodere.
Perché è importante per imprenditori e direzioni marketing
Il terzo spam update annuale di Google e la questione dei crawler AI che ignorano robots.txt segnalano che il perimetro della SEO si è allargato: non basta più ottimizzare i contenuti, occorre presidiare la reputazione digitale nei sistemi AI e controllare attivamente chi accede ai propri contenuti e come. Per le PMI italiane, ignorare queste dinamiche significa cedere terreno a competitor che si adattano prima.
Impatto su SEO, GEO, AEO e AI Search
Lo spam update impatta la visibilità organica su Google per siti con segnali ambigui di qualità. La pre-selezione dei brand da parte dei modelli AI introduce un nuovo livello di competizione che opera indipendentemente dal ranking tradizionale. Chi non costruisce autorevolezza di brand nelle fonti citate dai modelli AI rischia di essere escluso dalla visibilità nelle ricerche conversazionali indipendentemente dalla posizione su Google.
Checklist operativa
- Verificare nei Google Search Console eventuali cali di traffico post-18 agosto e identificare le pagine colpite
- Eseguire un audit dei contenuti generati con AI presenti nel sito: sono revisionati da un esperto? Aggiungono valore editoriale reale?
- Controllare i log del server per identificare i bot AI che accedono al sito, incluso ChatGPT-Fetch
- Valutare se i contenuti riservati o sensibili sono adeguatamente protetti oltre il solo robots.txt
- Mappare le principali query di settore e verificare come i principali modelli AI (ChatGPT, Gemini, Perplexity) rispondono: il brand è menzionato?
- Presidiare le fonti autorevoli di settore in italiano con contenuti citabili e strutturati (FAQ, definizioni, dati originali)
- Rivedere il profilo backlink alla ricerca di link artificiali o provenienti da siti spam prima che Google li penalizzi
- Implementare un monitoraggio continuativo del traffico bot con tool dedicati o analisi diretta dei log
Come Libellula Lab 4.0 può aiutarti
Libellula Lab 4.0 supporta aziende e PMI italiane nell'audit SEO post-update, nella strategia editoriale orientata sia alla SEO classica che alla visibilità nei sistemi AI (GEO), e nel monitoraggio della reputazione digitale del brand nei principali modelli linguistici. Il nostro approccio integra analisi tecnica, produzione di contenuti con supervisione editoriale umana e consulenza strategica su canali organici e AI search.
Libellula Lab 4.0
Vuoi trasformare questo tema in un vantaggio competitivo?
Analizziamo sito, processi, contenuti, campagne e automazioni per individuare opportunità concrete di crescita per la tua azienda.






