Jak przyspieszyc indeksacje strony w Google, gdy nowe podstrony nie wchodza
Nowe podstrony nie trafiaja do indeksu Google czesto nie dlatego, ze sa zlej jakosci, ale przez bledy techniczne: bledny canonical, brak linkow wewnetrznych, przeciazony crawl budget. Dowiedz sie, jak to zdiagnozowac w Search Console i naprawic krok po kroku.
Nowe podstrony siedzace tygodniami poza indeksem to jeden z tych problemow, ktore wyglupaja wlascicieli stron i SEO-owcow jednakowo. Technicznie strona dziala, tresci sa, sitemap jest wyslany - a Google jakby nie zauwaza. W wiekszosci przypadkow, ktore naprawialem u klientow przez ostatnie 13 lat, przyczyna nie lezy w jakosci tresci. Lezy w kilku dobrze znanych pulapkach technicznych, ktore da sie zdiagnozowac w ciagu 20 minut w Google Search Console.
Ponizej opisuje caly proces: od raportu GSC, przez crawl budget i orphan pages, po Indexing API i sitemap. Pokazuje tez, jak rozroznic sytuacje, gdzie wystarczy jedno klikniecie, od tych, gdzie trzeba powaznie popatrzec na architekture strony.
Zanim cokolwiek - sprawdz raport "Strony" w GSC
Google Search Console - sekcja Indeksowanie, potem "Strony" - to pierwsze miejsce, od ktorego nalezy zaczac. Raport pokazuje dwie kluczowe listy: strony zaindeksowane i strony niezaindeksowane, posegregowane wedlug przyczyny. Kazda przyczyna to osobna kategoria z liczba URL.
Nie patrz tylko na liczbe zaindeksowanych stron. Kliknij w "Dlaczego strony nie sa indeksowane" i przejdz przez kazda kategorie z wiecej niz kilkoma URL-ami. To tam kryje sie diagnoza.
Najczesciej spotykane statusy niezaindeksowanych stron to:
- "Odkryte - aktualnie nie zaindeksowane" (Discovered - currently not indexed) - Google wie o stronie, ale jej jeszcze nie odwiedzil.
- "Zeskanowane - aktualnie nie zaindeksowane" (Crawled - currently not indexed) - Google byl na stronie i swiadomie postanowil jej nie indeksowac.
- "Zduplikowane bez wybranej wersji kanonicznej" - Google znalazl kilka wersji tej samej tresci i nie wie, ktora ma priorytet.
- "Strona z tagiem noindex" - strona jest technicznie wykluczona z indeksu.
- "Zablokowane przez robots.txt" - Googlebot nie ma dostepu.
Kazdy z tych statusow ma inne rozwiazanie. Nie ma sensu stosowac tych samych poprawek do wszystkich.
"Odkryte - aktualnie nie zaindeksowane": przeciazony crawl budget
Jesli duzo URL-i lacy sie w status "Odkryte, ale nie zaindeksowane", to zazwyczaj oznacza jeden z dwoch scenariuszy: Google zna te adresy, ale nie ma czasu ich odwiedzic, albo uwaza je za mniejszy priorytet niz inne strony w Twojej domenie.
Crawl budget to liczba podstron, ktore Googlebot jest gotow odwiedzic w okreslonym czasie. Dla malych serwisow (do 200-300 URL) praktycznie nie jest problemem. Ale gdy masz sklep WooCommerce z kilkoma tysiącami produktow, filtrami cenowymi, tagami i kategoriami - Googlebot bardzo szybko "wypalic" budzet na strony, ktore nie maja zadnej wartosci SEO.
Jak uwolnic crawl budget - podstawowe dzialania
- Zablokuj w robots.txt strony z parametrami URL (np. ?sort=price, ?page=2, ?ref=newsletter)
- Dodaj noindex do stron wynikow wyszukiwania wewnetrznego (?s=fraza)
- Zablokuj strony kont uzytkownikow i koszykow (w WooCommerce: /cart/, /checkout/, /my-account/)
- Usun z sitemapy URL z kodem odpowiedzi 301, 302 lub 404
- Sprawdz logi serwera (lub raport "Statystyki indeksowania" w GSC) - czy Googlebot nie traci czasu na setki blednych URL
U klienta z duzym sklepem Shoper, ktory mial okolo 4000 produktow, odkrylem kiedys, ze Googlebot spedzal 60% czasu na stronach kategorii z filtrami (kombinacje kolor+rozmiar+cena tworzace setki unikalnych URL-i). Po skonfigurowaniu nocanonical i robots.txt dla parametrow filtrowania, nowe produkty zaczely wchodzic do indeksu w 3-5 dni zamiast 3-4 tygodnie.
"Zeskanowane - aktualnie nie zaindeksowane": Google ocenilo strone jako slaba
To powazniejszy sygnal. Status "Crawled - currently not indexed" oznacza, ze Googlebot odwiedzil strone, przeanalizowal ja i podjal swiadoma decyzje o nieindeksowaniu. Przyczyny bywaja rozne:
Typowe przyczyny statusu Crawled - currently not indexed
| Przyczyna | Co oznacza | Jak sprawdzic |
|---|---|---|
| Niska jakosc tresci | Strona ma zbyt malo tresci merytorycznej lub kopiuje inne podstrony | Przejrzyj strone reczne - czy rzeczywiscie ma unikalna, wyczerpujaca tresc |
| Duplikat bez wybranego canonical | Kilka URL wskazuje na ta sama tresc, Google wybral inna wersje jako kanonike | Sprawdz URL Inspection Tool - co Google pokazuje jako "canonical wybrany przez Google" |
| Canonical wskazuje gdzie indziej | Wtyczka SEO ustala canonical na inny adres | Wyswietl zrodlo strony i znajdz tag link rel=canonical |
| Noindex w metadanych | Strona ma meta robots noindex - czesto przez przypadek | Sprawdz URL Inspection Tool i przejrzyj ustawienia wtyczki SEO |
| Braki techniczne | Wolne ladowanie, bledy JavaScript, brak dostepnosci dla bota | Uzyj testu "Sprawdz na zywo" w URL Inspection i sprawdz screenshot renderowania |
Specjalne miejsce zajmuja strony produktow WooCommerce z bardzo skromnym opisem - trzy zdania, zdjecie i cena. Google w 2025-2026 roku jest wrazliwy na thin content znacznie bardziej niz kilka lat temu. Jesli konkurencja ma rozbudowane opisy, Twoja strona produktowa z 50 slowami moze nie wejsc do indeksu lub wyjsc z niego po pewnym czasie.
Canonical: cicha przyczyna utraty indeksacji
Tag canonical to jeden z najczesciej zepsuty elementow technicznych w WordPressie. Wskazuje Googlowi, ktora wersja URL jest "oryginalna" do zaindeksowania. Problem pojawia sie, gdy:
- Strona wskazuje canonical na siebie, ale istnieje identyczna wersja pod innym adresem (www/bez www, http/https, z ukosnikiem/bez)
- Wtyczka SEO generuje canonical na strone paginacji (/kategoria/page/2/) zamiast na strone glowna kategorii
- WooCommerce tworzy produkty dostepne pod kilkoma URL (warianty, kategorie)
Jak sprawdzic canonical dla konkretnej strony: wejdz w GSC, wybierz URL Inspection, wpisz adres i sprawdz pole "URL kanonicznego wybrany przez Google". Jesli rozni sie od URL-a, ktory wpiszesz, to masz problem. Google sygnalizuje wtedy, ze wybral inna wersje strony niz Ty wskazales - i to ta inna wersja bedzie (lub nie bedzie) zaindeksowana.
W WooCommerce czesto pojawia sie sytuacja, gdy produkt jest dostepny pod /produkt/nazwa-produktu/ i /kategoria/podkategoria/nazwa-produktu/. Jesli nie ustawisz canonical explicite (Yoast, Rank Math) lub nie wylaczysz jednej z wersji URL, Google sam wybierze kanonik - i moze wybrac nie ten, ktory chcesz.
Orphan pages: strony sieroce, ktore Googlebot nie znajdzie
Orphan pages to podstrony bez zadnego przychodzacego linku wewnetrznego. Sa w sitemapie, ale nie ma na nie zadnego kliknienia z innych podstron witryny. Google technicznie moze je znalezc przez sitemap, ale w praktyce takie strony sa indeksowane znacznie wolniej i rzadziej niz te, na ktore prowadza linki.
To jeden z tych problemow, ktore sa niewidoczne, dopoki nie sprawdzisz tego recznie. Screaming Frog (w wersji darmowej do 500 URL), Ahrefs Site Audit lub plugin OrphanPages dla WordPress pozwola Ci zidentyfikowac wszystkie URL, na ktore nie wskazuje zadna inna strona w ramach Twojego serwisu.
W praktyce: u klienta prowadzacego portal z poradnikami mielismy okolo 80 artykulow, ktore byly w sitemapie, ale nie byly podlinkowane z zadnego innego artykulu ani menu. Po dodaniu do kazdego artykulu 2-3 linkow kontekstowych z powyzszych tekstow, po 3 tygodniach 70% tych stron pojawilo sie w indeksie. Wczesniej siedzily poza nim od kilku miesiecy.
Sitemap XML: najczestsze bledy sabotujace indeksacje
Sitemap to instrukcja dla Googlebota, ale tylko wtedy, gdy jest poprawna. Czeste bledy, ktore sabotuja caly proces:
Sitemap zawiera URL z przekierowaniami. Jesli URL w sitemapie zwraca 301 lub 302, Googlebot traci czas na sledzenie przekierowania. Sitemap powinna zawierac wylacznie finalne URL, ktore zwracaja kod 200.
Sitemap zawiera URL z noindex. Sprzecznosc: mowisz Googlowi "odwiedz te strony" i jednoczesnie "nie indeksuj ich". Google ignoruje takie URL lub marnuje na nie crawl budget.
Brak aktualizacji sitemapy po publikacji. WordPress z Yoast SEO lub Rank Math regeneruje sitemap automatycznie - ale jesli uzywasz statycznej sitemapy lub masz ja skeszowana, nowe podstrony moga nie trafiac do pliku.
Kilka siteemap naraz, nie polaczonych przez sitemap index. Google preferuje jeden glowny plik sitemap-index.xml, ktory odwoluje sie do podplikow (sitemap-posts.xml, sitemap-pages.xml, sitemap-products.xml itd.). Yoast i Rank Math generuja to automatycznie.
Jak sprawdzic: wejdz w GSC, sekcja Indeksowanie, Sitemaps. Zobaczysz liste wyslanych sitemapp, date ostatniego crawlu i ewentualne bledy. Jesli obok sitemapy widnieje blad lub liczba "odkrytych URL" jest znacznie nizsza niz faktyczna liczba podstron, masz problem.
robots.txt i blokowanie zasobow: pulapka dla nieostroznych
Robots.txt to plik, ktory mowi Googlowi, co moze, a czego nie moze odwiedzac. Jesli zablokujesz w nim pliki CSS lub JavaScript, Googlebot nie bedzie mogl poprawnie wyrenderowac Twojej strony. A Google od lat indeksuje strony przez rendering - tzn. wczytuje takze skrypty i style, tak jak robi to przegladarka.
Najczestszy blad w WordPress: automatyczne generowanie robots.txt przez starsze wtyczki lub szablony, ktore blokuja /wp-content/ lub /wp-includes/. Po tym Googlebot widzi strone bez stylowania - i moze zdecydowac o nieindeksowaniu lub niezaliczeniu jej do poprawnych wynikow.
Jak sprawdzic: skorzystaj z testu "Sprawdz na zywo" w URL Inspection Tool. Po wykonaniu testu zobaczysz screenshot tego, co Googlebot widzial podczas ostatniej wizyty. Jesli screenshot wyglada inaczej niz strona w przegladarce (brak stylowania, brak grafik), to sygnalizuje problem z dostepem do zasobow.
Plusy
- robots.txt pozwala skutecznie zablokowac strony parametryczne i zaoszczedzic crawl budget
- Dobra konfiguracja przyspiesza indeksacje waznych podstron
- Mozna precyzyjnie kontrolowac, co Googlebot odwiedza
Minusy
- Jeden blad moze zablokowac zasoby krytyczne (CSS, JS) i zepsuc rendering dla Googlebota
- Blokada robots.txt nie usuwa URL z indeksu - Google moze pokazac strone bez tresci
- Zmiany w robots.txt sa procesowane przez Googlebota z opoznieniem (cache do 24h)
Google Indexing API i IndexNow: przyspieszone zglaszanie URL
Dla stron, ktore regularnie publikuja nowe tresci i nie moga czekac kilku tygodni na indeksacje, sa dwa narzedzia warte uwagi.
Google Indexing API pozwala wyslac URL bezposrednio do Google z prosba o natychmiastowe przeindeksowanie. Oficjalnie przeznaczone jest dla stron z danymi strukturalnymi JobPosting i BroadcastEvent - czyli oferty pracy i transmisje na zywo. W praktyce bywa uzywane szerzej, a w 2025 roku nadal dzialalo skutecznie, skracajac czas indeksacji do kilku minut. Wymaga konfiguracji konta serwisowego w Google Cloud Console, co jest niewielka praca jednorazowa, ale nie jest rozwiazaniem dla calkowicie nietech uzytkownikow.
IndexNow to protokol opracowany przez Bing i Yandex, ktory pozwala jednym zadaniem HTTP powiadomic wiekszosc wyszukiwarek o nowej lub zmienionej stronie. Google go nie obsluguje - wiec nie przyspiesza indeksacji w Google Search. Ale Bing i Yandex reaguja w ciagu minut. Dla biznesow B2B i klientow z krajow DACH (Niemcy, Austria, Szwajcaria) Bing dostarcza realne klikniecia - szczegolnie ze wzrostem udzialu Copilota, ktory korzysta z indeksu Binga. Aktywacja w Rank Math (darmowy plan) lub Yoast Premium zajmuje 2 minuty.
Dla wiekszosci witryn (do kilkuset podstron, publikowanie kilka razy w tygodniu) Indexing API nie jest konieczne. Solidna struktura wewnetrzna, poprawny sitemap i usuniete bledy techniczne w GSC w zupelnosci wystarczaja.
Jak sprawdzic poszczegolna podstrone - URL Inspection krok po kroku
Jesli konkretna podstrona nie wchodzi do indeksu, URL Inspection Tool to Twoja pierwsza linia diagnozy. Jak uzyc:
1. Wejdz na pozycjonowanie-seo i upewnij sie, ze Twoja strona jest zweryfikowana w GSC (warunek wstepny).
2. W GSC kliknij w pole wyszukiwarki na gorze i wklej pelny URL podstrony (z https:// i ewentualnym ukosnikiemna koncu).
3. Przeczytaj status: "URL jest w Google" lub "URL nie jest w Google".
4. Kliknij "Sprawdz na zywo" - to pyta Google o aktualny stan, nie o dane z cache.
5. Sprawdz pole "URL kanonicznego wybrany przez Google". Jesli rozni sie od URL, ktory wpisales - masz problem z canonicalem.
6. Przejdz do zakladki "Indeksowanie" i sprawdz, czy nie ma aktywnej reguly noindex lub blokady robots.txt.
7. Obejrzyj screenshot - czy strona wyglada tak jak powinna?
Jesli wszystko wyglada poprawnie, a strona nadal nie jest w indeksie - kliknij "Zarz¹daj indeksowaniem". To sygnal dla Googlebota, ze strona jest gotowa. Efekt zazwyczaj widac w ciagu 1-7 dni.
Linkowanie wewnetrzne jako fundamentalny mechanizm indeksacji
Googlebot odkrywa nowe strony glownie przez sledzie linkow. Jesli nowa podstrona nie ma zadnego linku wewnetrznego z juz zaindeksowanych stron, Googlebot znajdzie ja tylko przez sitemap - a sitemap to dla niego wskazowka, nie nakaz.
Praktyczna zasada, ktora stosuje u wszystkich klientow: kazda nowa podstrona powinna byc podlinkowana z co najmniej jednego, juz zaindeksowanego adresu. Moze to byc:
- link ze strony kategorii
- link kontekstowy z powiazanego artykulu blogowego
- wpis w menu bocznym lub stopce (choc te maja mniejsza wage)
- sekcja "Polecane" lub "Podobne produkty" w WooCommerce
Dla blogowania warto budowac tzw. klastry tematyczne: jeden artykul-hub, do ktorego linkuje kilka artykulow satelitarnych i vice versa. Opisuje te architekture szczegolowo w artykule o SEO i widocznosci w AI na 2026 rok.
Jesli prowadzisz sklep WooCommerce i regularnie dodajesz produkty, sprawdz, czy widget "Podobne produkty" i "Polecane produkty" jest aktywny na stronach produktow. To nie tylko UX - to realne linki wewnetrzne, ktore pomoga nowym produktom trafic do indeksu szybciej.
Co zrobic, gdy strona od miesiaca jest poza indeksem
Jesli podstrona tkwi w statusie niezaindeksowanym dluzej niz 4-6 tygodni po publikacji, to jest czas na systematyczna diagnoze. Oto kolejnosc dzialan:
Systematyczna diagnoza braku indeksacji - kolejnosc dzialan
- Sprawdz URL Inspection Tool - jaki dokladnie status, jaki canonical wybrany przez Google
- Sprawdz screenshot renderowania - czy strona wyglada poprawnie
- Sprawdz zrodlo strony pod katem meta robots noindex
- Sprawdz robots.txt - czy URL lub zasoby nie sa zablokowane
- Sprawdz, ile linkow wewnetrznych prowadzi do tej strony (Screaming Frog, Ahrefs, GSC - Linki)
- Sprawdz jakosc tresci obiektywnie - czy strona ma minimum 300-500 slow unikalnej tresci
- Sprawdz, czy w sitemapie jest prawidlowy, finalny URL (bez przekierowania)
- Sprawdz raport Crawl Stats w GSC - czy Googlebot odwiedzal domene regularnie
- Jesli wszystko OK - kliknij "Zarzadaj indeksowaniem" i poczekaj 7 dni
- Jesli po 7 dniach nadal nic - rozwazen analize crawl logow lub konsultacje SEO
Wiekszosc problemow rozwiazuje sie juz na etapie 1-4. Rzadko dochodzi do sytuacji, gdzie wszystko jest technicznie poprawne, a strona i tak nie wchodzi - ale to sie zdarza, np. gdy domena ma historycznie slaba reputacje lub gdy strona trafi w filtr jakosci. O tym, ile trwa wyjscie z filtra i co to w ogole oznacza, pisalem odrebnie w artykule ile trwa wyjscie z filtra Google.
Kiedy warto zleczyc audyt techniczny
Samodzielna diagnoza w GSC i URL Inspection pokrywa 80% przypadkow. Ale sa sytuacje, gdzie potrzebny jest glebszy audyt techniczny: analiza crawl logow z serwera, sprawdzenie renderowania JavaScript, analiza duplikatow na duzej skali lub ocena jakosci tresci vs. wymagania Google po kolejnym update algorytmu.
Jesli prowadzisz sklep lub portal z kilkuset podstronami i czesc z nich regularnie wypada z indeksu lub nie wchodzi, warto sie przyjrzec budzet SEO. Koszty audytu technicznego zwracaja sie szybko, jesli dzieki niemu strony zaczynaja przyciagac ruch organiczny. Opisalem, z czego sklada sie ten typ pracy i co wchodzi w abonament SEO, w tekcie o cenniku SEO.
W dawidweb.com audyt techniczny indeksacji to standardowy element pracy z klientem - nie osobna usluga. Sprawdzam GSC, robots.txt, canonical, sitemap i linkowanie wewnetrzne zawsze jako czesc pracy nad widocznoscia strony. Bo indeksacja to punkt startowy: jesli Google nie widzi Twoich podstron, zadne optymalizacje tresci ani linkbuilding nie przynosza efektow.
Czas bardzo sie rozni. Dla domen z duzym autorytetem nowe podstrony moga pojawic sie w indeksie w ciagu kilku godzin. Dla mlodszych domen lub przy slabej strukturze wewnetrznej proces trwa od kilku dni do kilku tygodni. Oficjalna dokumentacja Google mowi o przedziale od 'kilku dni do kilku tygodni', co w praktyce oznacza, ze jesli strona nie pojawia sie po 4-5 tygodniach, warto poszukac problemu technicznego. To dwie rozne sytuacje. 'Discovered' oznacza, ze Google wie o istnieniu strony (znalazl ja przez sitemap lub linki), ale jeszcze jej nie odwiedzil - najczesciej przez przeciazony crawl budget lub brak priorytetyzacji. 'Crawled' to powazniejszy przypadek: Google juz odwiedzil strone i swiadomie zdecydowal sie jej nie indeksowac, zazwyczaj z powodu niskiej jakosci tresci, duplikatu lub problemu z canonicalem. Dziala, ale nie jest magicznym rozwiazaniem. Nalezy go traktowac jako 'pchnieciem' dla Googlebota, ktory zazwyczaj reaguje w ciagu kilku godzin do kilku dni. Przycisk jest ograniczony kwotowo - mozna go uzyc dla ograniczonej liczby URL dziennie. Nie zastapuje naprawy realnego problemu: jesli strona ma slaba trescia lub zepsuty canonical, Google nie zaindeksuje jej nawet po wyslaniu recznego zadania. Crawl budget to liczba podstron, ktore Googlebot jest gotow odwiedzic w okreslonym czasie. Dla malych stron (do 200-300 podstron) praktycznie nie ma znaczenia. Warto zaczac optymalizowac budzet dopiero od kilkuset URL-i lub gdy regularnie pojawiaja sie nowe podstrony, ktore nie wchodza do indeksu. Podstawowe dzialania: zablokuj w robots.txt strony parametryczne, strony z filtrowaniem (np. ?sort=price) i thinpage URL-e, ktore nie maja wartosci SEO. Google oficjalnie przeznacza Indexing API do stron z danymi strukturalnymi JobPosting i BroadcastEvent. Praktyka pokazuje, ze nieofficjalnie bywa uzywane szerzej i moze skrocic czas indeksacji do kilku minut. Wymaga jednak konfiguracji konta uslugowego w Google Cloud i integracji z CMS - to nie jest rozwiazanie 'jednym klikniciem'. Dla wiekszosci witryn lepszym wyborem jest zadbanie o solidna strukture wewnetrzna i regularnie aktualizowany sitemap. Nie. IndexNow to protokol wspierany przez Bing i Yandex, ale nie przez Google. Po aktywacji w Rank Math lub Yoast Premium przyspiesza pojawienie sie tresci w wynikach Binga (czesto w ciagu kilku minut), ale nie ma bezposredniego wplywu na Google Search. Mimo to warto go wlaczyc, bo Bing dostarcza mierzalny ruch organiczny, zwlaszcza w segmencie B2B i uzytkownicy z krajow DACH. Najszybciej przez krzyzowe porownanie: wyeksportuj liste URL z sitemap.xml, a potem uruchom crawl narzedziem typu Screaming Frog lub Ahrefs Site Audit i sprawdz, ktore URL z sitemapy nie maja zadnego przychodzacego linku wewnetrznego. Kazda taka strona to orphan page. W WordPress mozna tez uzyc pluginu OrphanPages lub skorzystac z raportu Ahrefs 'Orphan pages' jesli masz abonament. Oznacza to, ze Google 'wyybral swoja wersje kanoniczna' i zignorowal Twoja wskazowke - najczesciej dlatego, ze znalazl inna, lepsza wersje tej samej tresci lub wewnetrzne linki wyrazniej wskazuja na inny URL. Sprawdz, czy nie masz duplikatow tresci (wersja www i bez www, HTTP i HTTPS, z ukosnikiem i bez). Upewnij sie tez, ze linki wewnetrzne i sitemap wskazuja dokladnie na te sama wersje URL, ktora chcesz zaindeksowac.Najczęstsze pytania
Ile trwa indeksacja nowej podstrony w Google?
Czym rozni sie 'Crawled - currently not indexed' od 'Discovered - currently not indexed'?
Czy przycisk 'Zadaj indeksowanie' w Search Console faktycznie dziala?
Jak dziala crawl budget i kiedy zaczac sie nim martwic?
Czy mam uzywac Google Indexing API do zwyklych postow na blogu?
Czy IndexNow pomaga z indeksacja w Google?
Jak sprawdzic, czy moja strona ma orphan pages?
Co zrobic, gdy strona jest w sitemapie, ale Google pokazuje inny canonical niz ten, ktory ustawilem?
Potrzebujesz pomocy z projektem?
Robię strony WordPress i sklepy Shoper od 2500 zł. Partner Shoper, 120+ projektów.
- Odpowiedź w 24h
- Certyfikowany Partner Shoper
- 120+ zrealizowanych projektów
- Zgodność z RODO, pełna ochrona danych