Sprawdzacz indeksowalności

Sprawdź indeksowalność
Dalej

Strona może być w pełni poprawna, ale nie być widoczna dla wyszukiwarki, jeśli tylko jeden znacznik zawiera informację „noindex“ lub plik robots.txt blokuje robota indeksującego. Wpisz adres URL – to narzędzie oceni wszystkie sygnały używane przez Google: plik robots.txt, metatag robots, nagłówek X-Robots-Tag, kanoniczny adres docelowy oraz stan HTTP – i poinformuje cię, czy strona może zostać zaindeksowana, dlaczego oraz jakie zmiany należy wprowadzić, jeśli nie może.

Jak sprawdzić indeksowalność

  1. 1

    Wpisz adres URL

    Program do analizy strony pobiera adres URL tak, jak to robi Googlebot.

  2. 2

    Rozwiązuje problemy z przekierowaniem.

    Śledzony jest łańcuch przekierowań 301/302; oceniany jest ostateczny adres URL.

  3. 3

    Odczytuje każdy sygnał indeksowalności.

    Zasady pliku Robots.txt, meta robots, X-Robots-Tag, kanoniczny format, kod stanu.

  4. 4

    Wynik i uzasadnienie

    Indeksowalne / nieindeksowalne / częściowe, z precyzyjnym sygnałem, który doprowadził do wyroku.

Sygnały indeksowalności i ich kolejność występowania

Google ocenia zestaw sygnałów w określonym porządku; wystarczy jeden negatywny wynik w tej sekwencji, aby blokować indeksowanie.

Porządek oceny sygnałów

  1. Status HTTP: wymagany kod 2xx; łańcuchy kodów 3xx są śledzone; kody 4xx i 5xx kończą indeksację.
  2. robots.txt: jeśli adres URL jest zabroniony dla Googlebot, strona nigdy nie zostanie skanowana – co oznacza, że tagi noindex na niej nie będą widziane.
  3. Nagłówek X-Robots-Tag: wartość noindex w nagłówkach odpowiedzi HTTP blokuje indeksowanie.
  4. Meta robots: <meta name="robots" content="noindex"> blokuje indeksowanie.
  5. Kanoniczne: wskazanie na inny adres oznacza, że Google indeksuje właśnie ten adres.
  6. Jakość treści oraz wykrywanie duplikatów: Google może nie indeksować dane nawet w przypadku braku wyraźnych instrukcji.

Najczęstsze błędy, które są wykrywane

Problem Przyczyna
Cała sekcja nie jest indeksowana Zasada Disallow: w pliku robots.txt
Specyficzna strona nie została indeksowana noindex w metarobotach
Indeksowano z niepoprawnym adresem URL Wersja kanoniczna znajduje się w innym miejscu
Zatrzymano na poziomie 5xx Błąd serwera uniemożliwił przeszkakowanie
Konflikt Disallow + noindex Robots.txt blokuje indeksowanie, tag noindex nigdy nie zostaje odczytany
Staging przecieka do produkcji Pozostałość X-Robots-Tag: noindex ze środowiska testowego

Pułapka robots.txt + noindex

Jeśli wpiszesz adres URL w pliku robots.txt, Google go nigdy nie przeskanuje, więc nie dostrzegnie żadnej tagi noindex. Adres URL może jednak nadal pojawić się w wynikach wyszukiwania jako „pusty“ wpis zawierający wyłącznie adres URL bez opisu. Aby usunąć adres URL z indeksu poprawnie, pozwalaj na jego przeskanowanie i użyj taga noindex; blokuj przeskanowanie dopiero po tym, jak Google usunie ten adres z indeksu.

Testowanie z perspektywy Googlebot

Program do skanowania wysyła agenta użytkownika Googlebot, aby wszystkie metody typu „skanerzy widzą tylko X“ stosowane na stronie serwerowej były widoczne. Zawsze sprawdzaj adresy URL w środowisku produkcyjnym, a nie w środowisku testowym.

Najczęściej zadawane pytania

To, że dane mogą być indeksowane, oznacza jedynie brak barier technicznych; nie gwarantuje jednak faktycznego indeksowania. Decyzja Googleu podlega również ocenie jakości treści, obecności duplikatów oraz budżetu przeanalizowanego przez system skanowania. Aby uzyskać pewną odpowiedź bezpośrednio od Googlea, korzystaj z funkcji Inspekcji adresów URL w Search Console.

Zazwyczaj odpowiedzią jest wyłącznie metaroboty (lub X-Robots-Tag). Plik robots.txt blokuje przeszkakowy odwiedzanie stron, natomiast metaroboty blokują indeksowanie. Dla stron, które nie chcesz, by zostały indeksowane, należy dopuścić przeszkakowy odwiedzanie, aby Google mógł odczytać etykietę noindex.

Google ocenia ostateczny cel łańcucha przekierowań. Przekierowanie typu 301 z punktu A do punktu B oznacza, że w końcu Google indeksuje punkt B, a nie punkt A. System oceny symuluje ten proces, rozwiązywając wszystkie przekierowania przed dokonaniem oceny.

Strony wymagające autentyfikacji nie mogą być indeksowane zgodnie z definicją. Jeśli potrzebujesz ich optymalizacji dla wyszukiwarki, rozważ wersję przedstawioną publicznie.

Powiązane narzędzia

Narzędzie jest dostępne w innych językach