Un contenuto AI è un testo prodotto in tutto o in parte da un modello linguistico. Google non lo penalizza in quanto tale, uno dei miti SEO ancora in circolazione: nessuna delle sue norme cita l'origine del testo come motivo di declassamento. La domanda però è mal posta, perché il rischio reale non è una penalizzazione. È che il contenuto entri nell'indice, raccolga qualche impression per due o tre mesi e poi sparisca senza aver mai portato un clic, in una SERP dove le AI Overviews hanno già ridotto i clic disponibili.
Questo articolo mette insieme quattro studi che hanno misurato il fenomeno su campioni ampi, spiega perché arrivano a conclusioni che sembrano opposte, e aggiunge un dato di prima mano sul blog che stai leggendo.
Cosa dice Google, alla lettera
La posizione ufficiale sta in due documenti. Il primo sono le indicazioni sull'uso di contenuti creati con l'AI generativa, dove si legge che "l'utilizzo di strumenti di IA generativa o altri strumenti simili per generare molte pagine senza aggiungere valore per gli utenti potrebbe violare le norme di Google relative allo spam sull'abuso di contenuti su larga scala".
Il secondo sono le norme antispam, aggiornate il 15 maggio 2026, che definiscono l'abuso di contenuti su larga scala come la generazione di molte pagine "allo scopo principale di manipolare i posizionamenti e non di aiutare gli utenti".
Il soggetto della norma è la scala, non lo strumento. Mille pagine scritte a mano per riempire un sito di varianti della stessa keyword ricadono nella stessa definizione di mille pagine generate in batch.
Poi ci sono le linee guida per i quality rater, aggiornate a gennaio 2025. Assegnano il voto più basso, "Lowest", quando il contenuto principale di una pagina è "copiato, parafrasato, incorporato, generato automaticamente o da AI, o ripubblicato da altre fonti con poco o nessuno sforzo, poca o nessuna originalità e poco o nessun valore aggiunto per i visitatori". La citazione è stata riportata da Danny Goodwin su Search Engine Land. Nota la sequenza: la generazione automatica compare in un elenco insieme al copia-incolla e alla parafrasi, e la condizione che fa scattare il voto è quella finale, lo sforzo nullo. I rater non danno voti che entrano nell'algoritmo, ma il documento è la descrizione più esplicita che Google abbia mai fornito di cosa considera contenuto scadente.
Gli studi si contraddicono, e il motivo conta
Chi cerca conferme trova sia il dato che assolve l'AI sia quello che la condanna, spesso nella stessa settimana. Ecco i quattro campioni più ampi pubblicati finora, messi vicini.
| Studio | Campione e metodo | Risultato principale |
|---|---|---|
| Ahrefs, luglio 2026 | 1 milione di pagine dai primi 10 risultati di 100.000 SERP, giugno 2026; 150.000 con testo sufficiente per l'analisi. Detector proprietario | Il 5,3% delle pagine in posizione 1-3 è interamente AI. La quota media di testo AI passa dal 27,1% in prima posizione al 30,9% in decima |
| Semrush, aprile 2026 | 42.000 articoli di blog su 20.000 keyword, rilevazione novembre 2025. Detector GPTZero | Il testo interamente AI occupa la prima posizione nel 9% dei casi, quello umano nell'80,5% |
| SE Ranking, marzo 2026 | 20 domini nuovi, 100 articoli AI ciascuno, 20 nicchie, nessuna revisione umana, 16 mesi di osservazione | 71% delle pagine indicizzate il primo mese. Dal terzo al sesto mese solo il 3% resta nei primi 100 risultati |
| Rankability, 2026 | 487 risultati su keyword competitive, doppio detector (GPTZero e Originality) | L'83% dei risultati in prima pagina è classificato come scritto da umani |
Ahrefs e Semrush sembrano dire il contrario l'uno dell'altro. In realtà misurano cose diverse. Ahrefs, firmato da Ryan Law e Xibeijia Guan, guarda la quota di testo AI dentro ogni pagina e trova che quasi tutte le pagine posizionate sono ibride: nel loro campione di 900.000 pagine in lingua inglese di aprile 2025, il 74,2% conteneva già almeno una traccia di generazione automatica e solo il 2,5% risultava interamente AI. Semrush, con lo studio di Margarita Loktionova, misura invece una classificazione binaria della pagina intera, e la differenza si concentra tutta sulla prima posizione: dalla quinta in giù il divario si assottiglia.
C'è una riserva che entrambe le redazioni dichiarano ed è bene ripetere. I detector di contenuti AI sbagliano. Search Engine Land lo scrive esplicitamente commentando i dati Semrush: gli strumenti di rilevazione "sono notoriamente incoerenti e possono classificare male sia il testo umano sia quello generato". Ahrefs aggiunge che il proprio metodo di rilevazione "sarà diverso da come lo rileva Google". Sono studi sulla probabilità che un testo sembri generato, non sulla certezza che lo sia. Se ti interessa il funzionamento di questi strumenti, ne abbiamo parlato nella guida ai rilevatori di contenuti AI.
Il dato che spiega la contraddizione: la curva a sedici mesi
Lo studio più utile dei quattro è anche il meno citato in Italia, perché è l'unico longitudinale. Bogdan Babiak e il team di SE Ranking hanno comprato 20 domini nuovi, senza storia né backlink, e ci hanno pubblicato sopra 2.000 articoli generati e mai revisionati, cento per dominio, su query informative a bassa competizione in venti settori.
Il primo mese sembra un successo: il 71% delle pagine viene indicizzato, arrivano 122.102 impression, l'80% dei siti si posiziona per almeno cento keyword. Tra il terzo e il sesto mese resta nei primi cento risultati il 3% delle pagine. Al sedicesimo mese i venti siti hanno accumulato 1.092.079 impression complessive e 1.381 clic. Fanno 0,7 clic per articolo pubblicato, in un anno e quattro mesi.
Il 66,9% delle pagine è ancora indicizzato. Nessuna penalizzazione, nessuna deindicizzazione di massa. Semplicemente, appena arriva qualcosa di meglio, quelle pagine scendono e non risalgono. È la differenza tra un contenuto rimosso e un contenuto irrilevante, e sui report è molto più difficile da vedere.
Indicizzato, posizionato e cliccato sono tre cose diverse
Quasi tutte le discussioni italiane sul tema si fermano al primo gradino. Ma i gradini sono tre, e l'AI aiuta molto sul primo, poco sul secondo, quasi per niente sul terzo.
Lo vediamo sul nostro sito. Il blog di Visilay è cresciuto in fretta nell'ultimo anno, con articoli costruiti su fonti verificate ma con una struttura di produzione veloce. Questi sono i numeri reali di Search Console per le pagine sotto /it/blog/, traffico dall'Italia, nei tre mesi dal 27 maggio al 24 agosto 2026.
| Metrica | Valore |
|---|---|
| Pagine del blog con almeno un'impression | 38 |
| Impression totali | 6.827 |
| Clic totali | 12 |
| CTR medio | 0,18% |
| Posizione media | 50,8 |
| Pagine che hanno ricevuto almeno un clic | 2 su 38 |
Trentasei pagine su trentotto hanno raccolto zero clic in tre mesi. Non sono state penalizzate: sono indicizzate, hanno visibilità misurabile, e stanno in posizione cinquanta. Da lì non arriva niente. Il traffico che vale è concentrato su due URL, e sono i due che rispondono a una domanda su cui avevamo qualcosa di nostro da dire.
Pubblicarlo non ci fa una bella figura, ma è il dato più onesto che possiamo mettere in un articolo su questo tema, ed è esattamente la curva che SE Ranking ha misurato su venti domini. La quantità porta impression. Le impression non sono traffico. Se vuoi vedere il caso opposto, l'articolo sulla SEO per l'industria manifatturiera racconta un progetto in cui una singola keyword è passata dalla posizione 88 alla 2 con uno share of voice del 25,55%: lì il lavoro non era di volume.
Il contesto italiano, che nei dati internazionali non c'è
Applicare a Milano una statistica raccolta su SERP anglofone è un errore che si paga. Il mercato italiano ha una densità competitiva diversa e un'adozione dell'AI molto più recente.
Secondo il report Imprese e ICT dell'Istat, pubblicato il 15 dicembre 2025, la quota di imprese italiane con almeno dieci addetti che usa intelligenza artificiale è passata dal 5,0% del 2023 all'8,2% del 2024 al 16,4% del 2025. Tra le grandi imprese si arriva al 53,1%, tra le PMI al 15,7%. Di chi ha adottato l'AI, il 59,1% la usa per generare linguaggio scritto o parlato, immagini, video o audio.
Il primo ostacolo dichiarato da chi ci ha rinunciato è la mancanza di competenze, indicata dal 58,6% delle imprese. Tradotto in termini editoriali: in Italia siamo all'inizio della curva che negli Stati Uniti ha già saturato le SERP informative. Una nicchia dove i concorrenti pubblicano ancora poco resta aggredibile con contenuti assistiti dall'AI molto più a lungo di quanto lo sia una nicchia americana. È una finestra, e si sta chiudendo.
Dove l'AI conviene davvero nel flusso di lavoro
Nel sondaggio Semrush su 224 professionisti, il 64% dichiara un flusso guidato dall'uomo con assistenza AI e solo il 19% dice che l'AI migliora la qualità del testo. Il 70% cita la velocità come vantaggio principale. Il consenso pratico, dentro chi il mestiere lo fa, è che il modello serve nei passaggi laterali, non nella stesura.
- Ricerca e clustering: raggruppare centinaia di query per intento è un lavoro che il modello fa in minuti e una persona in giorni. Il metodo resta quello descritto nella guida alla keyword research, cambia lo strumento.
- Verifica dell'intento: far riassumere i primi dieci risultati per capire che formato si aspetta chi cerca, prima di decidere il proprio. Su questo abbiamo una guida dedicata all'intento di ricerca.
- Prima bozza di sezioni descrittive: definizioni, glossari, spiegazioni di concetti stabili. Sono le parti dove non c'è niente di originale da dire, e il modello le scrive bene.
- Revisione strutturale: chiedere cosa manca rispetto ai concorrenti è più utile che chiedere di scrivere.
- Traduzione e adattamento: con il limite che una traduzione di un pezzo americano, come diciamo spesso, in Italia non si posiziona quasi mai.
Quello che il modello non può fare è portare la materia: un numero misurato su un progetto vero, uno screenshot, un errore commesso e raccontato. È il motivo per cui i segnali di esperienza descritti nel framework E-E-A-T restano l'unica difesa strutturale, e per cui la prima domanda prima di pubblicare non è "come suona" ma "cosa contiene che altrove non c'è". Il metodo completo sta nella guida su come creare contenuti in ottica SEO.
Il secondo mercato: le risposte generative
C'è un dato che ribalta l'intuizione comune. Ahrefs ha analizzato un milione di SERP con AI Overviews e le pagine citate come fonte: il 3,6% è interamente generato da AI, l'8,6% interamente umano, l'87,8% ibrido. La correlazione tra quota di testo AI e ordine di citazione è 0,017, cioè zero. Lo studio, firmato da Si Quan Ong e Xibeijia Guan, è consultabile sul blog di Ahrefs.
I sistemi generativi non discriminano la fonte in base a come è stata scritta. Scelgono in base a struttura, chiarezza delle affermazioni e presenza di dati citabili. Che è poi il motivo per cui una tabella in HTML nativo viene letta e una tabella dentro un'immagine no. Chi lavora sulla visibilità nelle risposte generative lo sa già: le regole sono nella guida alla generative engine optimization e in quella su come apparire nelle risposte di ChatGPT.
Come capire se i tuoi contenuti stanno reggendo
Tre controlli su Search Console, da fare ogni trimestre su tutto quello che hai pubblicato negli ultimi diciotto mesi.
- Rapporto impression/clic per URL. Una pagina con centinaia di impression e zero clic non è un successo a metà: è in posizione trenta o cinquanta. Vale come le pagine del nostro blog nella tabella sopra.
- Traiettoria della posizione media a novanta giorni. Il pattern da temere è quello di SE Ranking: buon debutto, discesa lenta e costante, nessuna risalita. Se lo vedi su molti URL insieme, il problema è sistemico e riguarda il tipo di contenuto, non la singola pagina.
- Quota di URL con almeno un clic. È la metrica che nessuno guarda e l'unica che dice se stai costruendo un archivio o un magazzino. Se pubblichi trenta articoli l'anno e due portano traffico, hai un problema di selezione degli argomenti, non di scrittura. I criteri di scelta sono nella guida alle strategie SEO per il blog.
C'è un'implicazione che nel settore si dice poco. Se il contenuto AI non viene punito ma nemmeno premiato, il costo marginale di produrre una pagina in più è crollato per tutti, concorrenti compresi. Il vantaggio non sta più nel pubblicare di più di loro, perché anche loro possono. Sta nel pubblicare le poche cose che loro non possono scrivere, e nel togliere dal sito quelle che chiunque potrebbe. La seconda metà di questa frase è la parte che quasi nessuno fa. Se vuoi capire quali pagine del tuo sito rientrano nella seconda categoria, è il tipo di analisi con cui iniziamo ogni progetto SEO.
Domande frequenti
No. Nessuna norma di Google cita l'origine del testo come motivo di declassamento. Le norme antispam colpiscono l'abuso di contenuti su larga scala, cioè la generazione di molte pagine allo scopo principale di manipolare i posizionamenti, indipendentemente da come sono state prodotte. Lo studio Ahrefs di luglio 2026 su un milione di pagine non trova alcuna correlazione tra quota di testo generato e posizione.
Non è dimostrato che lo faccia con affidabilità, e Ahrefs precisa che il proprio metodo di rilevazione è diverso da quello di Google. I detector commerciali come GPTZero e Originality sbagliano in entrambe le direzioni: Search Engine Land, commentando i dati Semrush, scrive che sono notoriamente incoerenti. La domanda operativa utile non è se Google lo capisca, ma se il testo aggiunga qualcosa che altrove non c'è.
Non esiste una soglia dichiarata da Google. I dati Ahrefs di giugno 2026 mostrano che l'82,2% delle pagine in posizione 1-3 contiene meno del 50% di testo classificato come generato, e che le pagine con oltre l'80% di testo AI vengono indicizzate nel 40,35% dei casi contro il 49,28% delle altre. La quota non è una regola, è una conseguenza: le pagine miste vincono perché qualcuno ci ha messo dentro qualcosa di proprio.
Sì. Nell'analisi Ahrefs su un milione di SERP con AI Overviews, il 3,6% delle pagine citate come fonte è interamente generato da AI e l'87,8% è ibrido, con una correlazione tra quota di testo AI e ordine di citazione pari a 0,017. I sistemi generativi selezionano in base a struttura e dati citabili, non in base a chi ha scritto il testo. Per questo una tabella in HTML nativo viene letta mentre una tabella dentro un'immagine no.
Prima misurali. Nello studio SE Ranking a sedici mesi il 66,9% delle pagine restava indicizzato pur non portando traffico: non facevano danno diretto, semplicemente non rendevano. Il criterio pratico è la quota di URL con almeno un clic negli ultimi novanta giorni. Le pagine a zero clic e posizione media oltre la trentesima si riscrivono con materiale proprio o si accorpano, e si cancellano solo quando l'argomento è già coperto meglio altrove sul sito.