Pubblichi una pagina, aspetti una settimana e continua a non comparire su Google. Search Console dice «Rilevata» o «Scansionata», ma non indicizzata. Non stai subendo alcuna penalizzazione e non c'è nulla di tecnicamente rotto. La pagina semplicemente non ha superato l'asticella per entrare nell'indice di Google.
È uno dei problemi SEO più comuni e più fraintesi, perché entrare in Google non è un passo ma due: la tua pagina deve essere scansionata e poi Google deve decidere che vale la pena indicizzarla. Questa guida spiega la differenza, ti mostra come leggere ciò che Search Console ti sta davvero dicendo, ripercorre i veri motivi per cui le pagine non vengono indicizzate e sfata il mito del crawl budget che fa perdere tanto tempo.
Scansione e indicizzazione sono due passi diversi
Si dice «Google non ha scansionato la mia pagina» quando si intende «Google non l'ha indicizzata», ma sono fasi separate, e sapere quale è fallita ti dice cosa correggere.
Una pagina può restare bloccata in una qualsiasi di queste fasi, e la soluzione è ogni volta completamente diversa. Una pagina in attesa di essere scansionata ha un problema di rilevamento o di priorità. Una pagina scansionata ma non indicizzata ha un problema di qualità o di duplicazione. Se tante «correzioni» non cambiano nulla, è proprio perché si confondono questi due casi.
Cosa ti sta dicendo davvero Search Console
Il rapporto Indicizzazione delle pagine di Google assegna a ogni pagina esclusa uno stato preciso. La maggior parte delle persone non guarda mai oltre il conteggio. Ecco quelli che vedrai davvero, e cosa significa ciascuno:
| Stato | Cosa significa davvero |
|---|---|
| Rilevata, attualmente non indicizzata | Google conosce l'URL ma non l'ha ancora scansionato. Spesso un segnale di priorità o di capacità di scansione. |
| Scansionata, attualmente non indicizzata | Google ha letto la pagina e ha scelto di non indicizzarla. Di solito un segnale di qualità del contenuto. |
| Pagina duplicata senza una versione canonica specificata dall'utente | Google vede la pagina come un quasi-duplicato e ha indicizzato un'altra versione al suo posto. |
| Duplicata: Google ha scelto una pagina canonica diversa da quella dell'utente | Hai impostato una canonica, Google l'ha ignorata e ne ha scelta un'altra. |
| Esclusa da un tag «noindex» | La pagina dice a Google di non indicizzarla. Spesso per errore. |
| Bloccata dal file robots.txt | Il Googlebot non ha nemmeno avuto il permesso di scansionarla. |
| Soft 404 | La pagina sembra vuota o simile a un errore per Google, anche se restituisce un codice 200. |
Lo stato è la diagnosi. «Scansionata, non indicizzata» e «Rilevata, non indicizzata» puntano a problemi completamente diversi: parti sempre da qui prima di toccare qualsiasi cosa.
Perché le tue pagine non vengono indicizzate
Tolte le etichette, quasi tutti i casi si riducono a una manciata di cause:
- Contenuto scarso o di basso valore. Il motivo più comune dietro «Scansionata, attualmente non indicizzata». Google ha scansionato la pagina, l'ha giudicata non degna di essere archiviata ed è andato oltre. Le vittime abituali sono le pagine che ripetono ciò che decine di altre già dicono.
- Duplicazione e confusione delle canoniche. Pagine quasi identiche (varianti di prodotto, URL filtrati, testo standard) spingono Google a sceglierne una e a scartare le altre. Tag canonici assenti o contraddittori peggiorano le cose.
- Blocchi accidentali da noindex o robots.txt. Un
noindexsfuggito in un template o una regola generica dirobots.txtpossono tenere fuori intere sezioni in silenzio. Conviene controllarlo per primo, perché è una correzione di una riga. - Link interni deboli (pagine orfane). Se nulla sul tuo sito punta a una pagina, Google potrebbe non dare mai priorità alla sua scansione. Rilevamento e priorità di scansione dipendono molto dai link interni.
- Soft 404 ed errori tecnici. Pagine vuote, template rotti o risposte simili a errori dicono a Google che non c'è nulla da indicizzare.
Il crawl budget è il tuo problema? (Quasi mai)
Ogni volta che si parla di indicizzazione, qualcuno dà la colpa al «crawl budget». Per la stragrande maggioranza dei siti è una pista falsa. La stessa guida di Google sulla gestione del crawl budget è netta: è scritta per siti grandi (oltre 1 milione di pagine) o medi (oltre 10.000 pagine) con contenuti che cambiano molto rapidamente. Google afferma chiaramente che se le tue pagine vengono di solito scansionate lo stesso giorno in cui sono pubblicate, non hai affatto bisogno di leggere quella guida.
Quindi se gestisci un normale sito aziendale, un blog o un negozio con qualche centinaio o qualche migliaio di pagine, il crawl budget non è il motivo per cui le tue pagine mancano. La causa reale è quasi sempre la qualità o la duplicazione, non la capacità di scansione. Rincorrere il crawl budget su un piccolo sito è tempo che dovresti dedicare al vero problema.
Come risolverlo, passo dopo passo
- Parti dal rapporto Indicizzazione delle pagine. Raggruppa le pagine non indicizzate per stato. Lo stato ti dice quale problema hai prima di cambiare qualsiasi cosa.
- Escludi prima i blocchi accidentali. Cerca tag
noindexsfuggiti e regole dirobots.txt. Sono vittorie rapide che possono liberare intere sezioni. - Correggi la duplicazione. Imposta tag canonici chiari, consolida le pagine quasi identiche e rendi ogni pagina superstite davvero distinta.
- Migliora il contenuto scarso o eliminalo. Per «Scansionata, non indicizzata», o rendi la pagina molto più utile della concorrenza, oppure la poti perché smetta di diluire il tuo sito.
- Rafforza i link interni. Collega le pagine importanti da pagine pertinenti già indicizzate, così che Google le scopra e le dia priorità.
- Invia una sitemap pulita e usa «Richiedi l'indicizzazione» per le pagine davvero utili, poi porta pazienza. Indicizzare è una decisione, non un interruttore.
Come aiuta Sublim
Sublim ti dà entrambe le metà del quadro in un unico posto. Il suo crawler integrato fa emergere i problemi tecnici che tengono le pagine fuori dall'indice: link rotti, titoli, meta description e contenuti duplicati, metadati mancanti e pagine lente, tutto con un punteggio così puoi dare priorità.
E la sua integrazione con Search Console mostra direttamente il tuo stato di indicizzazione, pagine inviate rispetto a quelle indicizzate, con gli errori e gli avvisi segnalati da Google.
Poiché Sublim è anche il tuo analytics, fa qualcosa che uno strumento SEO a sé stante non può fare: incrocia le pagine indicizzate con il traffico organico reale, così puoi individuare le pagine che sono indicizzate ma non ricevono visite, quel contenuto di basso valore che spesso trascina il resto verso il basso. Non costringerà Google a indicizzare una pagina (niente può farlo), ma rende la diagnosi rapida e concreta invece di un'ipotesi.


