noindex a inne sygnały
- noindex, follow — strona nie trafia do indeksu, ale robot może podążać za linkami (najczęstszy wariant).
- noindex, nofollow — bez indeksu i bez przekazywania sygnałów linkowych dalej.
- robots.txt Disallow — blokuje crawl; nie gwarantuje usunięcia już zaindeksowanych URL-i.
- Nie łącz noindex z canonical wskazującym inną stronę — to sprzeczne komunikaty dla robota.
Dobre praktyki
- Stosuj noindex na stronach, które nie powinny rankować, ale mogą być linkowane (np. thank-you, parametry śledzące).
- Usuń z sitemapy XML adresy oznaczone noindex — spójność sygnałów ułatwia crawlowanie.
- Na stagingu używaj noindex globalnie (meta lub X-Robots-Tag), zanim środowisko będzie publiczne.
- Po zdjęciu noindex z produkcji sprawdź w GSC, czy URL wraca do indeksu — to nie dzieje się natychmiast.
Częste błędy
Przypadkowy noindex na szablonie (np. po wdrożeniu na staging i zapomnieniu meta) to jedna z najczęstszych regresji SEO. Monitoring techniczny i audyt meta robots pomagają wychwycić to, zanim spadnie ruch organiczny. Sam noindex nie usuwa strony z indeksu od razu — robot musi stronę ponownie odwiedzić i odczytać dyrektywę.
Przykład
Strona podziękowania po formularzu — dostępna dla użytkownika, ale bez indeksacji i z przekazywaniem sygnałów linkowych.
<meta name="robots" content="noindex, follow">X-Robots-Tag: noindex, nofollowFAQ
Czy noindex blokuje robot przed wejściem na stronę?
Nie. Robot może odwiedzić URL i odczytać dyrektywę. Aby ograniczyć crawl, użyj robots.txt lub odpowiedzi HTTP innej niż 200 — ale to osobny mechanizm.
Czy strona z noindex może być w sitemapie?
Technicznie tak, ale nie powinna. Sitemap sugeruje adresy do indeksacji; noindex mówi coś przeciwnego. Trzymaj te sygnały zgodne.
Źródła i dalsza lektura
- Google Search Central — Blokowanie indeksowania treści dokumentacja
- MDN — meta name="robots" dokumentacja
- RFC 9309 — The Robots Exclusion Protocol standard