Dołącz do listy oczekujących i otrzymaj Sublim Business za darmo na 3 miesiące  Skorzystaj z oferty

Web Analytics

Dlaczego Google nie indeksuje wszystkich Twoich stron (i jak to naprawić)

Jocerand LeroyJocerand Leroy
5 min czytania
#seo#indexing#search-console
Opublikowałeś stronę, ale Google jej nie indeksuje. Wejście do Google to dwa kroki: skanowanie, potem indeksowanie. Oto jak czytać to, co mówi Ci Search Console, prawdziwe powody, dla których strony nie są indeksowane, i dlaczego budżet crawlowania prawie nigdy nie jest Twoim problemem.
Dlaczego Google nie indeksuje wszystkich Twoich stron (i jak to naprawić)

Publikujesz stronę, czekasz tydzień, a ona wciąż nie pojawia się w Google. Search Console mówi „Wykryta” lub „Zeskanowana”, ale nie zaindeksowana. Nie dostajesz kary i technicznie nic nie jest zepsute. Strona po prostu nie przeszła progu, by trafić do indeksu Google.

To jeden z najczęstszych i najbardziej niezrozumianych problemów SEO, bo wejście do Google to nie jeden krok, ale dwa: Twoja strona musi zostać zeskanowana, a potem Google musi uznać, że warto ją zaindeksować. Ten przewodnik wyjaśnia różnicę, pokazuje, jak czytać to, co Search Console naprawdę Ci mówi, omawia prawdziwe powody, dla których strony nie są indeksowane, i obala mit budżetu crawlowania, który pochłania tyle czasu.

Skanowanie i indeksowanie to dwa różne kroki

Mówimy „Google nie zeskanował mojej strony”, mając na myśli „Google jej nie zaindeksował”, ale to osobne etapy, a wiedza, który zawiódł, mówi Ci, co naprawić.

1Wykrycie: Google dowiaduje się, że URL istnieje (z Twojej mapy witryny, linków wewnętrznych lub zewnętrznych).
2Skanowanie: Googlebot faktycznie pobiera stronę i czyta jej treść.
3Indeksowanie: Google ocenia stronę i decyduje, czy zapisać ją w indeksie, aby mogła się pozycjonować.

Strona może utknąć na każdym z tych etapów, a rozwiązanie jest za każdym razem zupełnie inne. Strona czekająca na zeskanowanie ma problem z wykryciem lub priorytetem. Strona zeskanowana, ale niezaindeksowana ma problem z jakością lub duplikacją. Jeśli tyle „poprawek” nic nie zmienia, to właśnie dlatego, że te dwa przypadki są mylone.

Trzyetapowy proces, jak strona trafia do Google: Wykrycie (Google dowiaduje się, że URL istnieje), Skanowanie (Googlebot pobiera stronę) i Indeksowanie (Google decyduje się ją zapisać), z zaznaczonymi dwoma punktami blokady: wykryta, ale nie zeskanowana oznacza problem z priorytetem, zeskanowana, ale niezaindeksowana oznacza problem z jakością lub duplikacją
Wejście do Google to nie jeden krok, ale trzy. To, gdzie strona utknęła, mówi Ci, co naprawić.

Co Search Console naprawdę Ci mówi

Raport Indeksowanie stron Google przypisuje każdej wykluczonej stronie konkretny status. Większość ludzi nigdy nie patrzy dalej niż na liczbę. Oto te, które naprawdę zobaczysz, i co każdy z nich naprawdę znaczy:

Status Co to naprawdę znaczy
Wykryta, obecnie niezaindeksowana Google zna URL, ale jeszcze go nie zeskanował. Często sygnał priorytetu lub przepustowości skanowania.
Zeskanowana, obecnie niezaindeksowana Google przeczytał stronę i zdecydował jej nie indeksować. Zwykle sygnał jakości treści.
Duplikat bez strony kanonicznej wybranej przez użytkownika Google widzi stronę jako niemal-duplikat i zaindeksował zamiast niej inną wersję.
Duplikat, Google wybrał inną stronę kanoniczną niż użytkownik Ustawiłeś kanoniczną, Google ją zignorował i wybrał inną stronę.
Wykluczona przez tag „noindex” Strona mówi Google, by jej nie indeksował. Często przez przypadek.
Zablokowana przez plik robots.txt Googlebot nie dostał nawet pozwolenia, by ją zeskanować.
Miękki błąd 404 Strona wygląda dla Google na pustą lub błędną, nawet jeśli zwraca kod 200.

Status to diagnoza. „Zeskanowana, niezaindeksowana” i „Wykryta, niezaindeksowana” wskazują na zupełnie różne problemy: zawsze zaczynaj tutaj, zanim czegokolwiek dotkniesz.

Dlaczego Twoje strony nie są indeksowane

Gdy odrzucisz etykiety, niemal każdy przypadek sprowadza się do garstki przyczyn:

  • Uboga lub niskiej wartości treść. Najczęstszy powód za „Zeskanowana, obecnie niezaindeksowana”. Google zeskanował stronę, uznał, że nie warto jej zapisać, i poszedł dalej. Zwykłymi ofiarami są strony, które powtarzają to, co dziesiątki innych już mówią.
  • Duplikacja i zamieszanie z kanonicznymi. Niemal identyczne strony (warianty produktu, filtrowane adresy URL, powtarzalny tekst) skłaniają Google do wybrania jednej i odrzucenia reszty. Brakujące lub sprzeczne tagi kanoniczne pogarszają sprawę.
  • Przypadkowe blokady przez noindex lub robots.txt. Zabłąkany noindex z szablonu albo ogólna reguła robots.txt mogą po cichu wykluczyć całe sekcje. Warto sprawdzić to najpierw, bo to poprawka na jedną linijkę.
  • Słabe linkowanie wewnętrzne (strony osierocone). Jeśli nic w Twojej witrynie nie linkuje do strony, Google może nigdy nie nadać priorytetu jej skanowaniu. Wykrycie i priorytet skanowania mocno zależą od linków wewnętrznych.
  • Miękkie błędy 404 i błędy techniczne. Puste strony, zepsute szablony lub odpowiedzi przypominające błąd mówią Google, że nie ma nic do zaindeksowania.

Czy budżet crawlowania to Twój problem? (Prawie nigdy)

Za każdym razem, gdy pojawia się temat indeksowania, ktoś obwinia „budżet crawlowania”. Dla ogromnej większości witryn to fałszywy trop. Sam poradnik Google o zarządzaniu budżetem crawlowania jest jednoznaczny: jest napisany dla dużych witryn (ponad 1 milion stron) lub średnich (ponad 10 000 stron) z bardzo szybko zmieniającą się treścią. Google wprost mówi, że jeśli Twoje strony są zwykle skanowane tego samego dnia, w którym je publikujesz, wcale nie musisz czytać tego poradnika.

Więc jeśli prowadzisz zwykłą witrynę firmową, blog albo sklep z kilkuset lub kilkoma tysiącami stron, budżet crawlowania nie jest powodem brakujących stron. Prawdziwą przyczyną prawie zawsze jest jakość lub duplikacja, a nie przepustowość skanowania. Gonienie za budżetem crawlowania na małej witrynie to czas, który powinieneś poświęcić prawdziwemu problemowi.

Jak to naprawić, krok po kroku

  • Zacznij od raportu Indeksowanie stron. Pogrupuj niezaindeksowane strony według statusu. Status mówi Ci, jaki masz problem, zanim cokolwiek zmienisz.
  • Najpierw wyklucz przypadkowe blokady. Sprawdź zabłąkane tagi noindex i reguły robots.txt. To szybkie zwycięstwa, które mogą odblokować całe sekcje.
  • Napraw duplikację. Ustaw jasne tagi kanoniczne, połącz niemal identyczne strony i spraw, by każda pozostała strona była naprawdę odrębna.
  • Wzmocnij ubogą treść albo ją usuń. Przy „Zeskanowana, niezaindeksowana” albo uczyń stronę znacznie bardziej użyteczną od konkurencji, albo ją przytnij, by przestała rozwadniać Twoją witrynę.
  • Wzmocnij linki wewnętrzne. Linkuj do ważnych stron z powiązanych, już zaindeksowanych stron, aby Google je wykrył i nadał im priorytet.
  • Prześlij czystą mapę witryny i użyj „Poproś o zindeksowanie” dla naprawdę wartościowych stron, a potem uzbrój się w cierpliwość. Indeksowanie to decyzja, nie przełącznik.

Jak pomaga Sublim

Sublim daje Ci obie połowy obrazu w jednym miejscu. Jego wbudowany crawler ujawnia problemy techniczne, które trzymają strony poza indeksem: zepsute linki, zduplikowane tytuły, meta opisy i treści, brakujące metadane oraz wolne strony, wszystko z punktacją, byś mógł ustalić priorytety.

A jego integracja z Search Console pokazuje Twój status indeksowania bezpośrednio, strony przesłane w porównaniu z zaindeksowanymi, wraz z błędami i ostrzeżeniami zgłaszanymi przez Google.

Integracja Sublim z Search Console pokazująca status indeksowania Google: znane zaindeksowane adresy URL w stosunku do sumy, procent pokrycia, dzienny rozkład stron zaindeksowanych, zeskanowanych-niezaindeksowanych i wykrytych-niezaindeksowanych oraz link do sprawdzenia każdego URL
Integracja Sublim z Search Console. W aplikacji możesz zejść znacznie głębiej w szczegóły.

Ponieważ Sublim jest też Twoją analityką, robi coś, czego samodzielne narzędzie SEO nie potrafi: zestawia zaindeksowane strony z prawdziwym ruchem organicznym, byś wyłapał strony, które są zaindeksowane, ale nie dostają wizyt, tę niskowartościową treść, która często ciągnie resztę w dół. Nie zmusi Google do zaindeksowania strony (nic tego nie zrobi), ale sprawia, że diagnoza jest szybka i konkretna zamiast zgadywania.

Zobacz, dlaczego Twoje strony nie są indeksowane

Wbudowany crawler Sublim ujawnia techniczne blokady, a integracja z Search Console pokazuje status przesłane vs. zaindeksowane obok Twojego prawdziwego ruchu organicznego.

Podsumowanie

Brakujące strony w Google rzadko są zagadką i prawie nigdy karą. Zaindeksowanie to dwa kroki, skanowanie, a potem indeksowanie, a Search Console mówi Ci dokładnie, który zawiódł, jeśli przeczytasz status. Zwykli winowajcy to uboga treść, duplikacja i przypadkowe blokady, a nie budżet crawlowania, który liczy się tylko dla bardzo dużych witryn.

Przeczytaj status, napraw prawdziwą przyczynę i zadbaj, by każda strona zasłużyła na swoje miejsce. Indeksowanie to decyzja Google, że Twoja strona jest warta zapisania: dlatego trwałe rozwiązanie jest zawsze takie samo, daj mu ku temu powód.

Jocerand Leroy
Autor
Jocerand Leroy
Kierownik ds. Analityki Internetowej i Prywatności

Jocerand pisze o analityce internetowej dbającej o prywatność, diagnostyce konwersji i wykorzystywaniu danych bez kompromisów w zakresie zgodności.

Zobacz wszystkie artykuły tego autora

Gotowy, by wypróbować Sublim?

Prosta, szybka analityka szanująca prywatność. Rozpoczęcie jest bezpłatne.

Plan Business · 3 miesiące gratis na start · Kod promocyjny wysłany e-mailem

Dlaczego Google nie indeksuje Twoich stron (i jak naprawić) | Sublim