SEO techniczne | 7 min czytania

Dlaczego Google nie indeksuje strony – jak to naprawić

Strona nie pojawia się w Google? Sprawdź możliwe przyczyny braku indeksacji i zobacz, jak zdiagnozować konkretny URL w Search Console.

Z

Zespół Semsters

Semsters

Dlaczego Google nie indeksuje strony – jak to naprawić
Spis treści

Google może znać adres strony, a mimo to nie dodać go do indeksu. Powodem bywa blokada techniczna, błąd serwera, duplikat albo ocena URL-a. Sitemap i zgłoszenie w Search Console nie gwarantują indeksacji.

Sprawdź adres w narzędziu Sprawdzanie adresu URL w Google Search Console. Zobaczysz, czy Google może pobrać stronę, jaki adres uznaje za kanoniczny i dlaczego URL nie znalazł się w indeksie.

TL;DR

  • Crawlowanie oznacza pobranie strony przez Googlebota, a indeksowanie — przetworzenie jej i ewentualne dodanie do indeksu.
  • Zacznij od sprawdzenia adresu w Search Console, odpowiedzi HTTP, dyrektyw noindex, reguł robots.txt i adresu kanonicznego.
  • Komunikaty „Wykryto — obecnie nie zindeksowano” i „Strona zeskanowana, ale jeszcze nie zindeksowana” opisują różne etapy procesu.
  • Sitemap i funkcja „Poproś o zindeksowanie” pomagają Google odkryć lub ponownie sprawdzić URL, ale nie gwarantują indeksacji.
  • Crawl budget zwykle wymaga osobnej analizy dopiero w dużych albo bardzo często aktualizowanych serwisach.

Czym różni się indeksowanie od crawlowania?

Crawlowanie to pobieranie strony przez robota Google. Indeksowanie następuje później: Google analizuje treść, grupuje podobne adresy, wybiera wersję kanoniczną i ocenia, czy stronę dodać do indeksu. Nie każdy pobrany URL zostanie zaindeksowany.

Do indeksu kwalifikują się strony dostępne dla Google, zwracające prawidłową odpowiedź HTTP i zawierające treść możliwą do przetworzenia. Te warunki nadal nie gwarantują indeksacji — Google mówi o tym wprost.

Dlaczego Google nie indeksuje strony?

Przyczynę trzeba powiązać z komunikatem dla konkretnego adresu:

Co sprawdzićCo może pokazać Search ConsoleCo zrobić
Dyrektywa noindex„Wykluczono na podstawie tagu noindex”Usuń noindex z meta tagu lub nagłówka X-Robots-Tag, jeśli strona ma trafić do indeksu
Dostęp dla Googlebota„Zablokowana przez plik robots.txt”Sprawdź właściwość i regułę w robots.txt; odblokuj crawlowanie, jeśli jest niezamierzona
Odpowiedź serwerabłędy 4xx, 5xx albo soft 404Przywróć właściwą treść pod kodem 200, popraw przekierowanie lub pozostaw 404/410, jeśli URL ma zniknąć
Adres kanonicznyduplikat albo alternatywna strona z prawidłowym tagiem strony kanonicznejPorównaj canonical zadeklarowany przez serwis z wybranym przez Google i ujednolić sygnały
Etap crawlowania„Wykryto — obecnie nie zindeksowano”Upewnij się, że adres jest dostępny, występuje w aktualnej sitemapie i ma prowadzące do niego linki
Ocena po pobraniu„Strona zeskanowana, ale jeszcze nie zindeksowana”Sprawdź treść, duplikaty, soft 404, renderowanie i wybraną wersję kanoniczną
Ręczne działanieinformacja w raporcie „Ręczne działania”Usuń wskazane naruszenie i dopiero potem wyślij prośbę o ponowne rozpatrzenie

noindex i robots.txt pełnią inne funkcje

Dyrektywa noindex służy do wykluczenia strony z indeksu. Google musi jednak móc pobrać URL, aby tę dyrektywę zobaczyć. Jeśli ten sam adres zablokujesz w robots.txt, robot nie odczyta noindex, a sam URL może nadal pojawić się w wynikach bez opisu. Dlatego nie używaj robots.txt jako zamiennika noindex.

Canonical jest wskazówką, a nie bezwzględnym poleceniem

Jeśli kilka adresów ma bardzo podobną treść, Google wybiera reprezentatywny URL. Element rel="canonical", przekierowania, linki wewnętrzne i adresy w sitemapie pomagają wskazać preferowaną wersję, ale Google może wybrać inną.

Nie ustawiaj canonicala na ten sam adres tylko po to, aby wymusić indeksację. Najpierw sprawdź, czy strona jest odrębna od wersji wybranej przez Google. Jeśli to duplikat, wykluczenie alternatywnego adresu może być prawidłowe.

„Wykryto” i „zeskanowano” nie oznaczają tego samego

Status „Wykryto — obecnie nie zindeksowano” oznacza, że Google zna URL, ale jeszcze go nie pobrał. Z kolei „Strona zeskanowana, ale jeszcze nie zindeksowana” informuje, że robot odwiedził adres, lecz strona nie trafiła do indeksu.

Drugi komunikat nie dowodzi, że tekst jest „za krótki”. Sprawdź odpowiedź serwera, renderowanie, podobieństwo do innych stron, canonical i użyteczność zawartości.

Jak sprawdzić, czy strona jest zaindeksowana?

Dla pojedynczego adresu użyj narzędzia Sprawdzanie adresu URL w Google Search Console. Operator site: może pomóc w szybkim, orientacyjnym sprawdzeniu serwisu, ale nie zastępuje danych dla konkretnego URL-a w Search Console.

  1. Wklej pełny adres do pola u góry Search Console.
  2. Odczytaj stan indeksowania oraz datę ostatniego crawlowania.
  3. Porównaj adres kanoniczny zadeklarowany przez użytkownika z adresem wybranym przez Google.
  4. Uruchom Test wersji opublikowanej, aby sprawdzić bieżącą odpowiedź strony, a nie tylko ostatnią wersję znaną Google.
  5. Jeśli problem dotyczy wielu adresów, przejdź do raportu Indeksowanie stron i pogrupuj URL-e według przyczyny.

Brak wyniku dla zapytania site:pełny-adres nie jest ostatecznym dowodem wykluczenia. Wyniki operatorów wyszukiwania nie pokazują kompletnego stanu indeksu.

Jak naprawić brak indeksacji krok po kroku?

Nie każda strona niezaindeksowana wymaga naprawy. Przekierowania, duplikaty, strony po filtrach i celowo wyłączone treści mogą prawidłowo pozostawać poza indeksem. Najpierw ustal, czy dany URL powinien pojawiać się w wynikach.

  1. Sprawdź bieżącą wersję strony. URL przeznaczony do indeksacji powinien być publicznie dostępny, zwracać kod 200 i pokazywać właściwą treść także Googlebotowi.
  2. Usuń sprzeczne blokady. Skontroluj noindex, X-Robots-Tag, robots.txt, wymaganie logowania oraz zabezpieczenia CDN lub serwera.
  3. Zweryfikuj canonical. Upewnij się, że canonical, przekierowania, linki wewnętrzne i sitemap wskazują tę samą preferowaną wersję adresu.
  4. Oceń zawartość strony. Porównaj ją z podobnymi URL-ami. Usuń przypadkowe duplikaty i strony wyglądające jak soft 404; nie dopisuj tekstu tylko dla liczby słów.
  5. Dodaj dostępny link wewnętrzny. Ważna strona nie powinna być osierocona. Umieść odnośnik w logicznym miejscu serwisu zgodnie z planem linkowania wewnętrznego.
  6. Zaktualizuj sitemapę. Umieszczaj w niej pełne, kanoniczne adresy stron, które mają znaleźć się w wynikach. Sitemap pomaga w odkrywaniu URL-i, lecz nie wymusza indeksacji.
  7. Poproś o zindeksowanie po naprawie. Użyj tej funkcji dla ważnych adresów. Przy większej liczbie zmian wyślij aktualną sitemapę.

Kiedy trzeba analizować crawl budget?

Crawl budget ma znaczenie przede wszystkim dla dużych lub szybko zmieniających się serwisów. Dokumentacja Google o crawl budget kieruje szczegółowe zalecenia głównie do witryn z około milionem unikalnych stron, serwisów z ponad 10 tysiącami szybko aktualizowanych stron oraz witryn z dużą liczbą adresów oznaczonych jako „Wykryto — obecnie nie zindeksowano”. To orientacyjne wielkości, nie sztywne progi.

W małym serwisie zacznij od dostępności strony, noindex, odpowiedzi HTTP, canonicala, linków wewnętrznych i sitemapy. W dużym przeanalizuj też logi serwera i raport statystyk indeksowania.

Ile czasu zajmuje indeksacja po naprawie?

Nie ma gwarantowanego terminu. Google zaznacza, że crawlowanie i indeksowanie zależą od wielu czynników, dlatego nie da się obiecać, że każdy poprawny URL trafi do indeksu w ciągu kilku dni czy tygodni.

Po zmianie sprawdź test wersji opublikowanej, zgłoś ważny adres jeden raz i monitoruj status. Wielokrotne wysyłanie tej samej prośby nie przyspiesza procesu. Jeśli status się nie zmienia, wróć do diagnozy.

Kiedy brak indeksacji wskazuje na większy problem?

Gdy jednocześnie znika wiele ważnych stron, sprawdź elementy wspólne: szablon, globalny noindex, robots.txt, serwer, canonicale, sitemapę i linki wewnętrzne.

Po migracji strony skontroluj przekierowania oraz to, czy nowe URL-e zwracają 200 i są używane w całym serwisie. Nagły spadek nie musi oznaczać kary — najpierw wyklucz błąd techniczny i sprawdź raport „Ręczne działania”.

Najczęstsze pytania

Czy zgłoszenie adresu w Search Console gwarantuje indeksację?

Nie. Funkcja „Poproś o zindeksowanie” przekazuje URL do ponownego sprawdzenia, ale Google nadal decyduje, czy i kiedy go zeskanować oraz dodać do indeksu.

Czy sitemap.xml wystarczy, aby strona została zaindeksowana?

Nie. Sitemap pomaga Google odkrywać preferowane adresy i jest jednym z sygnałów wyboru wersji kanonicznej. Nie gwarantuje pobrania ani indeksacji strony.

Czy każda niezaindeksowana strona jest błędem SEO?

Nie. Poza indeksem powinny pozostać między innymi niektóre duplikaty, adresy techniczne i treści celowo oznaczone noindex. Problem pojawia się wtedy, gdy Google nie indeksuje ważnego, kanonicznego URL-a przeznaczonego dla użytkowników wyszukiwarki.

Czy blokada w robots.txt usuwa stronę z Google?

Nie zawsze. robots.txt blokuje crawlowanie, a nie służy do usuwania URL-a z indeksu. Aby wykluczyć stronę, użyj noindex i pozwól Google ją pobrać albo zabezpiecz treść logowaniem.

Udostępnij artykuł

Powiązane artykuły

Sprawdź Semsters za darmo

14 dni, pełny dostęp, bez karty kredytowej.

Wypróbuj za darmo