Co marnuje crawl budget
- Nieskończone kombinacje parametrów i filtrów (faceted navigation).
- Duplikaty bez kanonikalizacji i łańcuchy przekierowań.
- Strony błędów miękkich (soft 404) i niskiej jakości treści.
- Wolny serwer — wysoki TTFB obniża limit crawl rate.
Jak nim zarządzać
Podstawy to: aktualna sitemapa XML z datami modyfikacji, blokowanie bezwartościowych ścieżek w robots.txt, spójna kanonikalizacja, szybkie odpowiedzi serwera oraz zwracanie 404/410 dla treści trwale usuniętych. Statystyki indeksowania w Google Search Console pokazują, na co faktycznie idzie budżet.
Przykład
Sklep z fasetową nawigacją generuje tysiące wariantów URL z parametrami — bez blokady robot traci budżet na kopie filtrów zamiast na karty produktów.
/produkty?kolor=czerwony&rozmiar=42&sort=cena
/produkty?kolor=niebieski&rozmiar=42&sort=cena
/produkty?kolor=zielony&marka=nike&sort=nowosci
… (tysiące kombinacji)User-agent: *
Disallow: /produkty?*
Allow: /produkty/