La keyword density è la percentuale di parole di una pagina occupate dalla parola chiave che vuoi posizionare. Si calcola dividendo le occorrenze della keyword per il numero totale di parole del testo e moltiplicando per cento.
Abbiamo misurato quel numero su 29 articoli di questo blog, contando una per una le occorrenze esatte della focus keyword impostata in Yoast. La mediana è 0,3%. Diciannove articoli su ventinove stanno sotto lo 0,5%, cioè sotto la soglia che il plugin segnala come troppo bassa. Nessuno arriva al 3%. E la variabile che spiega quasi tutta la differenza tra un articolo e l'altro non è come sono scritti: è quante parole ha la keyword.
Come si calcola la keyword density
La formula è una divisione: (occorrenze della keyword ÷ numero totale di parole della pagina) × 100. Su un testo di 2.000 parole, dieci occorrenze valgono lo 0,5%.
Il conto si complica con le keyword di più parole, perché i tool non contano allo stesso modo. Alcuni dividono le occorrenze per il totale delle parole. Altri moltiplicano prima le occorrenze per il numero di parole della keyphrase, dato che una frase di quattro parole occupa quattro caselle del testo e non una. Stesso articolo, stessa keyword, e i due metodi restituiscono numeri che differiscono di quattro volte. Nelle misure di questo articolo abbiamo usato il secondo, che corrisponde anche al comportamento descritto da Yoast: più la keyphrase è lunga, meno occorrenze servono per far scattare il verde.
Prima di misurare qualsiasi cosa vale la pena chiedersi se la keyword è quella giusta, e questo si decide in fase di keyword research guardando l'intento di ricerca, non a testo finito.
Le percentuali che circolano non le ha scritte Google
Quando qualcuno ti dice che la densità ideale è l'1%, sta ripetendo la soglia di un plugin, uno dei miti SEO più duri a morire. I numeri che girano nel settore italiano hanno una provenienza precisa e documentata, e non è la documentazione di Google.
| Fonte | Intervallo indicato | Cosa succede fuori intervallo |
|---|---|---|
| Yoast SEO (versione gratuita) | 0,5% – 3% | Semaforo verde solo dentro l'intervallo; conta solo le corrispondenze esatte |
| Yoast SEO Premium e Shopify | fino a 3,5% | Riconosce le forme flesse della keyphrase (treno, treni, allenare, allenato) |
| Rank Math | 1% – 1,5% | Punteggio pieno solo dentro; avviso di eccesso oltre il 2,5% |
| All in One SEO | 0,5% o più | Indica il 2% come soglia di attenzione per il keyword stuffing |
| Documentazione Google | nessuna percentuale | Il keyword stuffing è definito a parole, mai con una soglia numerica |
Le fonti sono le pagine ufficiali dei plugin: Yoast scrive testualmente che "nella versione gratuita di Yoast SEO per WordPress ottieni il semaforo verde se la keyphrase density è tra lo 0,5 e il 3%", mentre la knowledge base di Rank Math chiede di "assicurarsi che la keyword density sia tra l'1% e l'1,5%" per prendere il punteggio pieno. Sono soglie di prodotto, scelte da chi ha scritto il plugin. Nessuna delle due proviene da una dichiarazione di Google.
Cosa dice Google, alla lettera
Nelle spam policy di Google Search il keyword stuffing è definito come "riempire una pagina di parole chiave o numeri nel tentativo di manipolare il posizionamento". Gli esempi elencati sono tre: liste di numeri di telefono senza valore aggiunto, blocchi di testo che elencano città e regioni, ripetizione delle stesse parole "così spesso da suonare innaturale". Non c'è una percentuale, e non c'è mai stata: il criterio è qualitativo.
Nella pagina di Search Central su come creare contenuti utili c'è una domanda di autovalutazione che vale anche qui, applicata al conteggio parole: "Stai scrivendo per raggiungere un certo numero di parole perché hai sentito dire che Google ha un numero di parole preferito? (No, non ce l'abbiamo)". La stessa logica regge per la densità.
La risposta più netta arriva da John Mueller, Search Advocate di Google. A fine dicembre 2021, in un thread su Reddit in cui gli veniva chiesto se la keyword density fosse ancora un fattore SEO, ha risposto "no", secco. La vicenda è documentata da Search Engine Roundtable il 7 gennaio 2022, che nota come Mueller ripeta la stessa cosa da circa dieci anni.
Il test: 29 articoli misurati uno per uno
Le dichiarazioni servono fino a un certo punto. Abbiamo preferito misurare. Il campione è l'archivio del blog di Visilay: tutti i post pubblicati con una focus keyword compilata e almeno 3.000 caratteri di testo, 29 articoli in tutto, per una media di circa 2.600 parole ciascuno.
Il metodo, così puoi rifarlo: contenuto ripulito da tag HTML e shortcode, testo normalizzato in minuscolo e senza accenti, tokenizzazione sulle sequenze alfanumeriche, conteggio delle occorrenze esatte della keyphrase come sequenza contigua di parole, densità calcolata come occorrenze per numero di parole della keyphrase, diviso il totale delle parole.
I risultati aggregati:
- densità mediana: 0,30%
- valore massimo su tutto l'archivio: 2,15% (articolo sui featured snippet)
- articoli sotto lo 0,5%, cioè sotto la soglia minima di Yoast: 19 su 29
- articoli sopra il 3%, cioè in zona rossa: zero
- articoli con densità esatta pari a 0,00%: 7
Una misura diversa sullo stesso archivio, con un metodo diverso, sta nel nostro articolo sul keyword stuffing: lì abbiamo preso 90 articoli e per ognuno il termine più ripetuto in assoluto, non la focus keyword, e i valori salgono fino al 6,62%. I due numeri non sono in contraddizione, misurano cose diverse: la parola singola più frequente di un testo e la frase esatta che stai cercando di posizionare non sono mai la stessa cosa.
Il pezzo interessante arriva quando i 29 articoli si raggruppano per numero di parole della keyphrase. La densità scende in modo regolare a ogni parola aggiunta, e il testo non c'entra niente.
| Parole nella keyphrase | Articoli | Densità mediana | Densità media | Densità massima |
|---|---|---|---|---|
| 1 (es. "serp", "geo") | 2 | 1,70% | 1,70% | 1,90% |
| 2 (es. "keyword stuffing") | 9 | 0,42% | 0,74% | 2,15% |
| 3 (es. "intento di ricerca") | 8 | 0,25% | 0,31% | 0,83% |
| 4 (es. "quanto costa la seo") | 10 | 0,14% | 0,26% | 1,33% |
Dalla keyphrase di una parola a quella di quattro la densità mediana crolla di dodici volte, da 1,70% a 0,14%. Gli articoli sono scritti dalle stesse persone, con lo stesso metodo, nella stessa lunghezza. L'unica cosa che cambia è la keyword. Il che vuol dire che quella percentuale misura la forma della tua keyword, non la qualità del tuo testo.
Perché succede: è matematica, non stile
Una keyphrase di quattro parole è una sequenza contigua. Perché il contatore la registri, quelle quattro parole devono comparire nell'ordine esatto, e in un testo scritto per essere letto succede raramente: chi scrive dice "quanto costa la SEO" una volta nel titolo e poi passa a "il budget", "la spesa mensile", "il costo di un progetto". Non è pigrizia, è come funziona la lingua.
Sotto c'è un motivo più profondo, ed è il modo in cui i sistemi di recupero delle informazioni trattano la frequenza dei termini. Nel modello BM25, descritto da Stephen Robertson e Hugo Zaragoza in The Probabilistic Relevance Framework: BM25 and Beyond (Foundations and Trends in Information Retrieval, volume 3, numero 4, 2009), il contributo di un termine alla rilevanza satura: le prime occorrenze contano, le successive aggiungono sempre meno, e la curva si appiattisce. È un comportamento previsto dalla formula, non una scelta editoriale di Google. Ripetere una parola venti volte invece di cinque non moltiplica per quattro la rilevanza, la aumenta di una frazione che tende a zero.
BM25 è un modello del 2009 e Google usa da anni sistemi ben più complessi, ma la saturazione della frequenza è una proprietà che i modelli successivi hanno mantenuto o accentuato. Chi vuole capire quali segnali contano davvero trova un quadro più ampio nella nostra guida ai fattori di ranking.
Il dato americano, e perché in Italia non si trasferisce
Sul mercato statunitense esiste una misura su campione ampio. Rankability ha analizzato 1.536 risultati di ricerca Google su 32 keyword competitive e ha trovato una densità media dello 0,04% per le posizioni da 1 a 10, contro lo 0,07% per le posizioni da 11 a 20 e lo 0,08% per quelle da 21 a 30. Il campione è statunitense e in lingua inglese, quindi il numero non va letto come una soglia da replicare in Italia. Va letto per la sua forma: le pagine che si posizionano meglio non hanno una densità più alta, e la relazione tra le due grandezze non è monotona.
C'è poi un problema che riguarda l'italiano e che nei pezzi in inglese non compare mai. L'italiano flette molto più dell'inglese, e i contatori che cercano corrispondenze esatte perdono per strada le forme derivate. Nel nostro campione l'articolo con focus keyword "obiettivi SEO" ha una sola occorrenza esatta ma quattro se si ammettono le varianti flesse. Quello sui featured snippet passa da 27 a 30 occorrenze. Quello su "motori di ricerca alternativi" passa da zero a una. Sono differenze che spostano il semaforo del plugin senza cambiare una virgola del testo. La versione a pagamento di Yoast riconosce le forme flesse, quella gratuita, che è quella installata sulla maggior parte dei siti italiani, no.
Quando la percentuale dice ancora qualcosa
La metrica non è inutile, è solo usata al contrario. Come obiettivo non serve. Come sintomo, in tre casi, sì.
- Densità sopra il 3% su un testo breve. Su una scheda prodotto da 200 parole, sei ripetizioni della stessa frase si notano leggendo. Qui il numero anticipa quello che un revisore umano direbbe comunque, e ti porta dritto nel territorio del black hat SEO senza che tu l'abbia deciso.
- Densità esatta pari a zero su una pagina che dovrebbe parlare di quella cosa. Non serve alzarla, serve capire perché: spesso significa che la pagina copre un sottotema diverso da quello per cui la stai spingendo, e il problema è di impianto on-page, non di frequenza.
- Densità identica su molte pagine dello stesso sito. È il caso che vediamo più spesso negli audit, e ne parliamo tra poco.
Cosa guardiamo al posto della percentuale
Tre controlli, in quest'ordine. Il primo è la copertura: quali sottoargomenti trattano le pagine che si posizionano e quali mancano nella tua, che è un lavoro di costruzione del contenuto e non di conteggio. Il secondo è la prominenza: dove compare la keyword, cioè se c'è nel titolo, nell'URL, nel primo paragrafo, in almeno un H2, nel title tag. Il terzo sono le entità nominate: aziende, tool, persone, luoghi, numeri con la fonte. Sono il segnale che distingue un testo scritto da chi il mestiere lo fa da uno riscritto da chi ha letto gli altri.
Un esempio dal nostro archivio, misurato e non raccontato. L'articolo su SEO per l'industria manifatturiera ha una densità esatta dello 0,00% sulla sua focus keyword: la frase completa non compare mai come sequenza contigua. Nei tre mesi tra il 1 giugno e il 28 agosto 2026 quella pagina ha una posizione media di 13,65 su Google Italia secondo Search Console, tra le migliori dell'intero blog. Contiene il caso di Macropix, produttore milanese di schermi LED su misura passato dalla posizione 88 alla 2 sulla keyword principale del suo mercato. Il lavoro che ha prodotto quel risultato non ha mai riguardato la frequenza di una parola.
Se il punto è capire da dove partire su un sito reale, ne parliamo nella pagina dei servizi SEO e negli altri progetti che abbiamo pubblicato con i numeri dentro.
L'unico uso della densità che ci è tornato utile
Misurata su una pagina sola la keyword density non dice niente. Misurata su tutto un archivio dice una cosa che nessun altro controllo mostra altrettanto in fretta: quali pagine stanno inseguendo la stessa keyword. Se in un sito di duecento articoli ne trovi otto con densità sopra l'1% sulla stessa frase, non hai otto pagine ottimizzate, hai una cannibalizzazione da risolvere prima di scrivere qualsiasi altra cosa. È un uso diagnostico e comparativo, sull'insieme, e si fa con una query sul database in due minuti. È anche il motivo per cui teniamo ancora quel campo compilato, mentre la soglia del semaforo la ignoriamo da anni. Il resto del lavoro passa per i link interni e per la scelta tra coda lunga e coda corta, non per un decimale.
Domande frequenti sulla keyword density
Non esiste un valore ideale stabilito da Google: nella documentazione ufficiale non compare nessuna percentuale. Gli intervalli che circolano sono soglie di prodotto dei plugin (0,5-3% per Yoast SEO gratuito, 1-1,5% per Rank Math). Sui 29 articoli del blog Visilay che abbiamo misurato la mediana è 0,3%, e diciannove su ventinove stanno sotto la soglia minima di Yoast.
No. John Mueller di Google ha risposto "no" alla domanda diretta in un thread su Reddit di fine 2021, ripreso da Search Engine Roundtable il 7 gennaio 2022, e la stessa posizione viene ripetuta da oltre dieci anni. Nelle spam policy di Google il keyword stuffing è definito in modo qualitativo, senza alcuna soglia numerica.
Si dividono le occorrenze della keyword per il numero totale di parole e si moltiplica per cento. Con una keyphrase di più parole i tool si dividono: alcuni contano le occorrenze, altri le moltiplicano prima per il numero di parole della frase. I due metodi danno risultati diversi anche di quattro volte sullo stesso testo, quindi prima di confrontare due misure conviene sapere quale formula usa il tool.
Non prima di aver verificato quante parole ha la tua keyphrase. Nel nostro campione la densità mediana passa da 1,70% con keyphrase di una parola a 0,14% con keyphrase di quattro, a parità di autore, metodo e lunghezza del testo. Se la frase è lunga, l’arancione del plugin sta descrivendo la forma della keyword, non un difetto del contenuto.
Dipende dallo strumento. La versione gratuita di Yoast SEO conta solo le corrispondenze esatte, mentre Yoast Premium e la versione Shopify riconoscono le forme flesse. In italiano la differenza è sensibile: su un nostro articolo le occorrenze passano da 1 a 4 semplicemente ammettendo le varianti flesse della stessa keyphrase.
Non è la percentuale in sé a essere sanzionata, ma il comportamento che di solito la produce. Google interviene sul keyword stuffing, cioè su testi in cui le parole chiave compaiono in elenchi, fuori contesto o ripetute al punto da suonare innaturali. Se il testo si legge bene, il numero non è un problema; se il numero è alto perché il testo è illeggibile, il problema è il testo.