Sprawdzacz indeksowalności
Strona może być w pełni poprawna, ale nie być widoczna dla wyszukiwarki, jeśli tylko jeden znacznik zawiera informację „noindex“ lub plik robots.txt blokuje robota indeksującego. Wpisz adres URL – to narzędzie oceni wszystkie sygnały używane przez Google: plik robots.txt, metatag robots, nagłówek X-Robots-Tag, kanoniczny adres docelowy oraz stan HTTP – i poinformuje cię, czy strona może zostać zaindeksowana, dlaczego oraz jakie zmiany należy wprowadzić, jeśli nie może.
Jak sprawdzić indeksowalność
-
1
Wpisz adres URL
Program do analizy strony pobiera adres URL tak, jak to robi Googlebot.
-
2
Rozwiązuje problemy z przekierowaniem.
Śledzony jest łańcuch przekierowań 301/302; oceniany jest ostateczny adres URL.
-
3
Odczytuje każdy sygnał indeksowalności.
Zasady pliku Robots.txt, meta robots, X-Robots-Tag, kanoniczny format, kod stanu.
-
4
Wynik i uzasadnienie
Indeksowalne / nieindeksowalne / częściowe, z precyzyjnym sygnałem, który doprowadził do wyroku.
Sygnały indeksowalności i ich kolejność występowania
Google ocenia zestaw sygnałów w określonym porządku; wystarczy jeden negatywny wynik w tej sekwencji, aby blokować indeksowanie.
Porządek oceny sygnałów
- Status HTTP: wymagany kod 2xx; łańcuchy kodów 3xx są śledzone; kody 4xx i 5xx kończą indeksację.
- robots.txt: jeśli adres URL jest zabroniony dla Googlebot, strona nigdy nie zostanie skanowana – co oznacza, że tagi noindex na niej nie będą widziane.
- Nagłówek X-Robots-Tag: wartość
noindexw nagłówkach odpowiedzi HTTP blokuje indeksowanie. - Meta robots:
<meta name="robots" content="noindex">blokuje indeksowanie. - Kanoniczne: wskazanie na inny adres oznacza, że Google indeksuje właśnie ten adres.
- Jakość treści oraz wykrywanie duplikatów: Google może nie indeksować dane nawet w przypadku braku wyraźnych instrukcji.
Najczęstsze błędy, które są wykrywane
| Problem | Przyczyna |
|---|---|
| Cała sekcja nie jest indeksowana | Zasada Disallow: w pliku robots.txt |
| Specyficzna strona nie została indeksowana | noindex w metarobotach |
| Indeksowano z niepoprawnym adresem URL | Wersja kanoniczna znajduje się w innym miejscu |
| Zatrzymano na poziomie 5xx | Błąd serwera uniemożliwił przeszkakowanie |
| Konflikt Disallow + noindex | Robots.txt blokuje indeksowanie, tag noindex nigdy nie zostaje odczytany |
| Staging przecieka do produkcji | Pozostałość X-Robots-Tag: noindex ze środowiska testowego |
Pułapka robots.txt + noindex
Jeśli wpiszesz adres URL w pliku robots.txt, Google go nigdy nie przeskanuje, więc nie dostrzegnie żadnej tagi noindex. Adres URL może jednak nadal pojawić się w wynikach wyszukiwania jako „pusty“ wpis zawierający wyłącznie adres URL bez opisu. Aby usunąć adres URL z indeksu poprawnie, pozwalaj na jego przeskanowanie i użyj taga noindex; blokuj przeskanowanie dopiero po tym, jak Google usunie ten adres z indeksu.
Testowanie z perspektywy Googlebot
Program do skanowania wysyła agenta użytkownika Googlebot, aby wszystkie metody typu „skanerzy widzą tylko X“ stosowane na stronie serwerowej były widoczne. Zawsze sprawdzaj adresy URL w środowisku produkcyjnym, a nie w środowisku testowym.
Najczęściej zadawane pytania
To, że dane mogą być indeksowane, oznacza jedynie brak barier technicznych; nie gwarantuje jednak faktycznego indeksowania. Decyzja Googleu podlega również ocenie jakości treści, obecności duplikatów oraz budżetu przeanalizowanego przez system skanowania. Aby uzyskać pewną odpowiedź bezpośrednio od Googlea, korzystaj z funkcji Inspekcji adresów URL w Search Console.
Zazwyczaj odpowiedzią jest wyłącznie metaroboty (lub X-Robots-Tag). Plik robots.txt blokuje przeszkakowy odwiedzanie stron, natomiast metaroboty blokują indeksowanie. Dla stron, które nie chcesz, by zostały indeksowane, należy dopuścić przeszkakowy odwiedzanie, aby Google mógł odczytać etykietę noindex.
Google ocenia ostateczny cel łańcucha przekierowań. Przekierowanie typu 301 z punktu A do punktu B oznacza, że w końcu Google indeksuje punkt B, a nie punkt A. System oceny symuluje ten proces, rozwiązywając wszystkie przekierowania przed dokonaniem oceny.
Strony wymagające autentyfikacji nie mogą być indeksowane zgodnie z definicją. Jeśli potrzebujesz ich optymalizacji dla wyszukiwarki, rozważ wersję przedstawioną publicznie.
Powiązane narzędzia
Sprawdzanie długości meta opisu
Zmierz meta opis w znakach i szacowanych pikselach, porównaj wskazówki redakcyjne i przejrzyj makiety na komputer i telefon.
Tester nagłówków bezpieczeństwa HTTP
Wklej nagłówki odpowiedzi HTTP i lokalnie sprawdź HSTS, CSP, ochronę ramek, MIME, referrer oraz zasady cross-origin.
Symulator wyników Google
Wyświetl przybliżony snippet w stylu Google z limitami znaków dla telefonu i komputera. Szkic pozostaje w tej sesji przeglądarki.
Walidator mapy witryny XML
Sprawdź w przeglądarce składnię XML mapy witryny, brakujące lokalizacje, powtarzające się adresy URL i typowe wartości pól.
Ekstraktor linków zewnętrznych
Wklej surowy kod HTML, opcjonalnie podaj adres URL podstawowy i otrzymaj czystą, bez duplikatów listę wszystkich zewnętrznych linków http/https w kodzie, na potrzeby audytów linków i analiz SEO.
Licznik częstotliwości słów
Znajdź najczęściej powtarzane słowa w tekście wraz z liczbą wystąpień i procentem gęstości. Przydatne przy redakcji, SEO i audytach treści.
Narzędzie jest dostępne w innych językach
- Indexierbarkeitsprüfer [DE]
- เครื่องตรวจสอบความสามารถในการจัดทำดัชนี (Indexability Checker) [TH]
- Công cụ kiểm tra khả năng lập chỉ mục [VI]
- Verificador de Indexabilidade [PT]
- Pemeriksa Indeksabilitas [ID]
- インデックス可能性チェッカー [JA]
- Indexerbarhetskontroll [SV]
- Verificador de Indexabilidad [ES]
- 인덱스화 가능성 검사기 [KO]
- Vérificateur d'indexabilité [FR]
- مدقق قابلية الفهرسة [AR]
- Indexerbaarheidscontrole [NL]
- İndekslenebilirlik Kontrolcüsü [TR]
- 可索引性检测器 [ZH]
- Indexability Checker [EN]
- Controllore di Indicizzabilità [IT]
- Инструмент проверки индексируемости [RU]