Iscriviti alla lista d'attesa e ottieni Sublim Business gratis per 3 mesi  Richiedi l'offerta

Web Analytics

Perché Google non indicizza tutte le tue pagine (e come rimediare)

Jocerand LeroyJocerand Leroy
6 min di lettura
#seo#indexing#search-console
Hai pubblicato la pagina, ma Google non la indicizza. Entrare in Google sono due passi: scansione, poi indicizzazione. Ecco come leggere ciò che Search Console ti dice, i veri motivi per cui le pagine non vengono indicizzate e perché il crawl budget non è quasi mai il tuo problema.
Perché Google non indicizza tutte le tue pagine (e come rimediare)

Pubblichi una pagina, aspetti una settimana e continua a non comparire su Google. Search Console dice «Rilevata» o «Scansionata», ma non indicizzata. Non stai subendo alcuna penalizzazione e non c'è nulla di tecnicamente rotto. La pagina semplicemente non ha superato l'asticella per entrare nell'indice di Google.

È uno dei problemi SEO più comuni e più fraintesi, perché entrare in Google non è un passo ma due: la tua pagina deve essere scansionata e poi Google deve decidere che vale la pena indicizzarla. Questa guida spiega la differenza, ti mostra come leggere ciò che Search Console ti sta davvero dicendo, ripercorre i veri motivi per cui le pagine non vengono indicizzate e sfata il mito del crawl budget che fa perdere tanto tempo.

Scansione e indicizzazione sono due passi diversi

Si dice «Google non ha scansionato la mia pagina» quando si intende «Google non l'ha indicizzata», ma sono fasi separate, e sapere quale è fallita ti dice cosa correggere.

1Rilevamento: Google scopre che l'URL esiste (dalla tua sitemap, dai link interni o da link esterni).
2Scansione: il Googlebot recupera davvero la pagina e ne legge il contenuto.
3Indicizzazione: Google valuta la pagina e decide se archiviarla nell'indice affinché possa posizionarsi.

Una pagina può restare bloccata in una qualsiasi di queste fasi, e la soluzione è ogni volta completamente diversa. Una pagina in attesa di essere scansionata ha un problema di rilevamento o di priorità. Una pagina scansionata ma non indicizzata ha un problema di qualità o di duplicazione. Se tante «correzioni» non cambiano nulla, è proprio perché si confondono questi due casi.

Pipeline in tre fasi di come una pagina entra in Google: Rilevamento (Google scopre che l'URL esiste), Scansione (il Googlebot recupera la pagina) e Indicizzazione (Google decide di archiviarla), con i due punti di blocco indicati: rilevata ma non scansionata indica un problema di priorità, scansionata ma non indicizzata indica un problema di qualità o di duplicazione
Entrare in Google non è un passo ma tre. Sapere dove una pagina resta bloccata ti dice cosa correggere.

Cosa ti sta dicendo davvero Search Console

Il rapporto Indicizzazione delle pagine di Google assegna a ogni pagina esclusa uno stato preciso. La maggior parte delle persone non guarda mai oltre il conteggio. Ecco quelli che vedrai davvero, e cosa significa ciascuno:

Stato Cosa significa davvero
Rilevata, attualmente non indicizzata Google conosce l'URL ma non l'ha ancora scansionato. Spesso un segnale di priorità o di capacità di scansione.
Scansionata, attualmente non indicizzata Google ha letto la pagina e ha scelto di non indicizzarla. Di solito un segnale di qualità del contenuto.
Pagina duplicata senza una versione canonica specificata dall'utente Google vede la pagina come un quasi-duplicato e ha indicizzato un'altra versione al suo posto.
Duplicata: Google ha scelto una pagina canonica diversa da quella dell'utente Hai impostato una canonica, Google l'ha ignorata e ne ha scelta un'altra.
Esclusa da un tag «noindex» La pagina dice a Google di non indicizzarla. Spesso per errore.
Bloccata dal file robots.txt Il Googlebot non ha nemmeno avuto il permesso di scansionarla.
Soft 404 La pagina sembra vuota o simile a un errore per Google, anche se restituisce un codice 200.

Lo stato è la diagnosi. «Scansionata, non indicizzata» e «Rilevata, non indicizzata» puntano a problemi completamente diversi: parti sempre da qui prima di toccare qualsiasi cosa.

Perché le tue pagine non vengono indicizzate

Tolte le etichette, quasi tutti i casi si riducono a una manciata di cause:

  • Contenuto scarso o di basso valore. Il motivo più comune dietro «Scansionata, attualmente non indicizzata». Google ha scansionato la pagina, l'ha giudicata non degna di essere archiviata ed è andato oltre. Le vittime abituali sono le pagine che ripetono ciò che decine di altre già dicono.
  • Duplicazione e confusione delle canoniche. Pagine quasi identiche (varianti di prodotto, URL filtrati, testo standard) spingono Google a sceglierne una e a scartare le altre. Tag canonici assenti o contraddittori peggiorano le cose.
  • Blocchi accidentali da noindex o robots.txt. Un noindex sfuggito in un template o una regola generica di robots.txt possono tenere fuori intere sezioni in silenzio. Conviene controllarlo per primo, perché è una correzione di una riga.
  • Link interni deboli (pagine orfane). Se nulla sul tuo sito punta a una pagina, Google potrebbe non dare mai priorità alla sua scansione. Rilevamento e priorità di scansione dipendono molto dai link interni.
  • Soft 404 ed errori tecnici. Pagine vuote, template rotti o risposte simili a errori dicono a Google che non c'è nulla da indicizzare.

Il crawl budget è il tuo problema? (Quasi mai)

Ogni volta che si parla di indicizzazione, qualcuno dà la colpa al «crawl budget». Per la stragrande maggioranza dei siti è una pista falsa. La stessa guida di Google sulla gestione del crawl budget è netta: è scritta per siti grandi (oltre 1 milione di pagine) o medi (oltre 10.000 pagine) con contenuti che cambiano molto rapidamente. Google afferma chiaramente che se le tue pagine vengono di solito scansionate lo stesso giorno in cui sono pubblicate, non hai affatto bisogno di leggere quella guida.

Quindi se gestisci un normale sito aziendale, un blog o un negozio con qualche centinaio o qualche migliaio di pagine, il crawl budget non è il motivo per cui le tue pagine mancano. La causa reale è quasi sempre la qualità o la duplicazione, non la capacità di scansione. Rincorrere il crawl budget su un piccolo sito è tempo che dovresti dedicare al vero problema.

Come risolverlo, passo dopo passo

  • Parti dal rapporto Indicizzazione delle pagine. Raggruppa le pagine non indicizzate per stato. Lo stato ti dice quale problema hai prima di cambiare qualsiasi cosa.
  • Escludi prima i blocchi accidentali. Cerca tag noindex sfuggiti e regole di robots.txt. Sono vittorie rapide che possono liberare intere sezioni.
  • Correggi la duplicazione. Imposta tag canonici chiari, consolida le pagine quasi identiche e rendi ogni pagina superstite davvero distinta.
  • Migliora il contenuto scarso o eliminalo. Per «Scansionata, non indicizzata», o rendi la pagina molto più utile della concorrenza, oppure la poti perché smetta di diluire il tuo sito.
  • Rafforza i link interni. Collega le pagine importanti da pagine pertinenti già indicizzate, così che Google le scopra e le dia priorità.
  • Invia una sitemap pulita e usa «Richiedi l'indicizzazione» per le pagine davvero utili, poi porta pazienza. Indicizzare è una decisione, non un interruttore.

Come aiuta Sublim

Sublim ti dà entrambe le metà del quadro in un unico posto. Il suo crawler integrato fa emergere i problemi tecnici che tengono le pagine fuori dall'indice: link rotti, titoli, meta description e contenuti duplicati, metadati mancanti e pagine lente, tutto con un punteggio così puoi dare priorità.

E la sua integrazione con Search Console mostra direttamente il tuo stato di indicizzazione, pagine inviate rispetto a quelle indicizzate, con gli errori e gli avvisi segnalati da Google.

L'integrazione con Search Console di Sublim mostra lo stato di indicizzazione di Google: URL noti indicizzati rispetto al totale, percentuale di copertura, ripartizione giornaliera delle pagine indicizzate, scansionate-non-indicizzate e rilevate-non-indicizzate, e un link per ispezionare ogni URL
L'integrazione con Search Console di Sublim. Nell'app puoi scendere molto più nel dettaglio.

Poiché Sublim è anche il tuo analytics, fa qualcosa che uno strumento SEO a sé stante non può fare: incrocia le pagine indicizzate con il traffico organico reale, così puoi individuare le pagine che sono indicizzate ma non ricevono visite, quel contenuto di basso valore che spesso trascina il resto verso il basso. Non costringerà Google a indicizzare una pagina (niente può farlo), ma rende la diagnosi rapida e concreta invece di un'ipotesi.

Scopri perché le tue pagine non vengono indicizzate

Il crawler integrato di Sublim rivela i blocchi tecnici, e la sua integrazione con Search Console mostra lo stato inviate vs. indicizzate accanto al tuo traffico organico reale.

In sintesi

Le pagine mancanti su Google sono raramente un mistero e quasi mai una penalizzazione. Essere indicizzati sono due passi, scansione e poi indicizzazione, e Search Console ti dice esattamente quale è fallito se leggi lo stato. I colpevoli abituali sono il contenuto scarso, la duplicazione e i blocchi accidentali, non il crawl budget, che conta solo per siti molto grandi.

Leggi lo stato, correggi la causa reale e assicurati che ogni pagina si guadagni il suo posto. Indicizzare è Google che decide che la tua pagina vale la pena di essere archiviata: per questo la soluzione duratura è sempre la stessa, dagli un motivo per farlo.

Jocerand Leroy
Autore
Jocerand Leroy
Responsabile Web Analytics e Privacy

Jocerand scrive di web analytics rispettoso della privacy, diagnostica delle conversioni e di come sfruttare i dati senza compromessi sulla conformità.

Vedi tutti gli articoli di questo autore

Pronto a provare Sublim?

Analisi semplici e veloci che rispettano la privacy. Iniziare è gratuito.

Piano Business · 3 mesi gratis al lancio · Codice promo inviato via email

Perché Google non indicizza le tue pagine (e come rimediare) | Sublim