Noindex w WordPress: jak przypadkowo nie zablokować strony przed Google i AI

TL;DR Noindex to dyrektywa (meta robots lub X-Robots-Tag), a nie narzędzie crawlującego, więc robots.txt jej nie zastępuje. Noindex zadziała tylko wtedy, gdy strona nie jest zablokowana w robots.txt. W WordPressie noindex włącza się przypadkowo w pięciu miejscach: Ustawienia → Czytanie, wtyczki SEO, motyw, staging/migracja i nagłówki serwera. Skutek jest podwójny: znikasz z Google i z cytowań w ChatGPT, Gemini czy Perplexity. Blokada treningu (GPTBot, Google-Extended, ClaudeBot, CCBot) to nie to samo co blokada cytowania (OAI-SearchBot, PerplexityBot, Claude-SearchBot). Powrót do indeksu trwa od dni do miesięcy, a przyspiesza go inspekcja URL w Search Console. Po lekturze samodzielnie sprawdzisz i naprawisz noindex oraz zabezpieczysz sklep checklistą pre/post-migracja.

Noindex w WordPress — co to jest i czym różni się od robots.txt

Noindex to polecenie dla wyszukiwarki: "nie pokazuj tej strony w wynikach". Możesz je wysłać na dwa sposoby: tagiem w kodzie strony (meta robots) albo nagłówkiem HTTP (X-Robots-Tag). Oba mówią to samo, tylko innym kanałem.

Największe nieporozumienie dotyczy robots.txt. To nie jest narzędzie do usuwania stron z indeksu. Robots.txt steruje tym, czy bot w ogóle może wejść na stronę (crawling). Noindex decyduje, czy strona trafi do wyników (indeksowanie). To dwie różne decyzje.

Mechanizm Co kontroluje Gdzie się go ustawia Usuwa z indeksu?
meta robots indeksowanie w kodzie strony (head) tak, po recrawlu
X-Robots-Tag indeksowanie nagłówek HTTP serwera tak, po recrawlu
robots.txt crawling plik robots.txt w katalogu głównym nie

Zasada, którą warto zapamiętać: noindex nie zadziała, jeśli strona jest zablokowana w robots.txt. Bot nie wejdzie na stronę, więc nie odczyta tagu. Google mówi o tym wprost w dokumentacji: "For the noindex rule to be effective, the page must not be blocked by a robots.txt file".

Przykład tagu w kodzie strony:

<meta name="robots" content="noindex, follow">

Przykład nagłówka serwera:

X-Robots-Tag: noindex, nofollow

Na co uważać: przed każdą zmianą w robots.txt upewnij się, że nie usuwasz reguł potrzebnych Google. Semly ostrzega, żeby nie wdrażać technicznych zmian na ślepo i najpierw zrozumieć, gdzie dokładnie dodajesz wpis. Jeden nieuważny wiersz potrafi odciąć całą witrynę.

Dlaczego przypadkowy noindex boli podwójnie — Google i AI

Kiedyś noindex oznaczał tylko utratę ruchu z Google. Dziś stawka jest wyższa, bo modele AI w dużej mierze opierają się na indeksach wyszukiwarek.

Dane, które to pokazują:

  • 76,1% URL-i cytowanych w AI Overviews pochodzi z top 10 wyników organicznych (Semly Knowledge, aktualizacja 13 lipca 2026).
  • Konwersja z ruchu AI wynosi 14,2%, a z ruchu organicznego 2,8% (Semly Knowledge, 2026).
  • ChatGPT miał około 900 mln aktywnych użytkowników tygodniowo (luty 2026).

Wniosek jest prosty. Jeśli Google nie widzi Twojej strony, modele AI też jej nie zobaczą. Noindex to nie tylko problem SEO, to także problem widoczności w AI.

Semly.ai pracuje dokładnie na tym styku. Platforma GEO (Generative Engine Optimization) pomaga sklepom e-commerce tłumaczyć ofertę na format zrozumiały dla modeli językowych i monitoruje, czy marka pojawia się w rekomendacjach ChatGPT, Gemini czy Claude. Ale żadne narzędzie nie pomoże, jeśli fundament, czyli indeksowalność, jest zepsuty. Indeksacja to warunek wejścia do gry.

5 miejsc w WordPressie, w których noindex włącza się przypadkowo

Ustawienia → Czytanie ("zachęć wyszukiwarki do indeksowania")

Objaw: cała witryna znika z Google, w kodzie pojawia się <meta name="robots" content="noindex">.

Sprawdź: Panel WP → Ustawienia → Czytanie. Zobacz, czy odznaczona jest opcja "Zachęć wyszukiwarki do indeksowania tej witryny".

Napraw: zaznacz tę opcję. To najczęstsza przyczyna masowego noindex, szczególnie po świeżej instalacji albo po pracy na kopii.

Wtyczki SEO: Yoast, Rank Math, All in One SEO

Objaw: pojedyncze strony, kategorie lub całe typy treści wypadają z indeksu.

Sprawdź: metabox w edytorze strony (zakładka zaawansowana), sekcję Titles & Meta w ustawieniach wtyczki oraz ewentualne masowe zmiany (bulk edit). Yoast domyślnie ustawia noindex m.in. na wewnętrznych wynikach wyszukiwania i stronach logowania.

Napraw: przełącz ustawienie na "Default" lub "Index". Po zmianach masowych sprawdź kilka losowych URL-i, bo łatwo przestawić cały typ treści.

Motyw i wtyczki dodające noindex

Objaw: noindex pojawia się bez śladu w panelu wtyczki SEO.

Sprawdź: podgląd źródła strony i wyszukaj "noindex". Jeśli tag jest, a wtyczka SEO go nie dodaje, sprawcą może być motyw lub inna wtyczka.

Napraw: znajdź plik motywu odpowiedzialny za nagłówek i usuń tag. Jeśli nie czujesz się pewnie w edycji plików, poproś o pomoc developera.

Staging/dev i migracje (noindex przeniesiony na produkcję)

Objaw: strona działa, ale nie pojawia się w Google. Wszystko wygląda dobrze, dopóki nie sprawdzisz kodu.

Sprawdź: czy środowisko staging miało włączony noindex i czy po migracji ustawienie nie zostało skopiowane na produkcję.

Napraw: wyłącz noindex na produkcji i zweryfikuj to narzędziami z sekcji diagnostycznej. To klasyczny błąd po przenosinach.

Nagłówki serwera, .htaccess/NGINX, WAF/CDN

Objaw: noindex nie ma w kodzie strony, ale pojawia się w nagłówku HTTP. Albo boty AI w ogóle nie docierają do serwera.

Sprawdź: nagłówki odpowiedzi serwera oraz ustawienia firewalla i CDN. Cloudflare i podobne narzędzia potrafią blokować boty niezależnie od robots.txt.

Napraw: usuń nagłówek X-Robots-Tag z konfiguracji serwera i przejrzyj reguły WAF. Sprawdź, czy nie blokujesz botów, które chcesz wpuszczać.

Noindex a crawlery AI — blokujesz trening czy cytowanie?

To dwie różne decyzje, które łatwo pomylić. Blokada treningu nie blokuje cytowania i odwrotnie.

Bot Do czego służy Respektuje robots.txt
GPTBot trening modeli OpenAI tak
OAI-SearchBot cytowanie w ChatGPT search tak
ChatGPT-User akcje użytkownika w czasie rzeczywistym zwykle nie
ClaudeBot trening Anthropic tak
Claude-SearchBot indeksowanie w wyszukiwaniu tak
Claude-User akcje użytkownika zwykle nie
PerplexityBot cytowanie w Perplexity tak
Perplexity-User akcje użytkownika zwykle nie
CCBot dataset Common Crawl (trening wielu modeli) tak
Google-Extended trening Gemini i grounding tak

Kluczowe wnioski:

  • Chcesz być cytowany w ChatGPT? Nie blokuj OAI-SearchBot. Blokada GPTBot dotyczy tylko treningu.
  • Google-Extended nie wpływa na obecność w Google Search ani na AI Overviews. Steruje treningiem Gemini.
  • Blokada CCBot wyklucza Cię z datasetów treningowych wielu modeli, często nieświadomie.
  • Zmiany w robots.txt propagują się u dostawców w około 24 godziny.

Decyzja o blokowaniu botów AI musi być świadoma. "Zablokuję wszystko na wszelki wypadek" to najgorszy scenariusz, bo odcina Cię od cytowań, nie chroniąc przy tym przed niczym konkretnym.

Diagnostyka krok po kroku — jak sprawdzić noindex w WordPressie

  1. Sprawdź nagłówki serwera. W terminalu wpisz:
curl -I https://twojadomena.pl

Szukaj linii X-Robots-Tag. Punkt kontrolny: jeśli widzisz "noindex", problem jest po stronie serwera.

  1. Sprawdź kod strony. Otwórz podgląd źródła i wyszukaj "noindex". Punkt kontrolny: tag w sekcji head oznacza noindex ustawiony w WordPressie.

  2. Wejdź do Search Console → Inspekcja URL → Test na żywo. Punkt kontrolny: narzędzie pokaże, co dokładnie widzi Googlebot.

  3. Otwórz Search Console → Raporty → Indeksowanie stron. Szukaj statusów:

    • "Excluded by noindex tag" (strona oznaczona noindex),
    • "Indexed, though blocked by robots.txt" (strona w indeksie mimo blokady),
    • "URL blocked by robots.txt".
  4. Przetestuj robots.txt w Search Console. Punkt kontrolny: sprawdź, czy nie blokujesz przypadkiem ważnych katalogów.

  5. Po naprawie kliknij "Validate Fix" w raporcie indeksowania. Walidacja może potrwać do około dwóch tygodni.

Najczęstsze błędy i jak je naprawić

Noindex i Disallow jednocześnie. Objaw: strona nie znika z indeksu mimo noindex. Przyczyna: bot nie może wejść na stronę, więc nie odczyta tagu. Naprawa: usuń regułę Disallow, zostaw sam noindex.

Noindex na całej witrynie zamiast na jednej stronie. Objaw: cały sklep wypada z Google. Przyczyna: przestawione ustawienie globalne w Ustawieniach → Czytanie albo w wtyczce SEO. Naprawa: przywróć indeksowanie globalne i ustaw noindex tylko tam, gdzie chcesz.

Zapomniany noindex po migracji. Objaw: nowa wersja strony nie pojawia się w wynikach. Przyczyna: ustawienie ze staging skopiowane na produkcję. Naprawa: wyłącz noindex i zweryfikuj nagłówki oraz kod.

Brak weryfikacji po naprawie. Objaw: nie wiesz, czy zmiana zadziałała. Przyczyna: brak testu po edycji. Naprawa: zawsze sprawdź curl, podgląd źródła i Live Test w GSC.

Blokada botów AI "na wszelki wypadek". Objaw: strona jest w Google, ale nie pojawia się w odpowiedziach AI. Przyczyna: zablokowane OAI-SearchBot, PerplexityBot lub Claude-SearchBot. Naprawa: odblokuj boty odpowiedzialne za cytowanie, zostawiając decyzję o treningu świadomie.

Edycja robots.txt bez zrozumienia. Objaw: nieoczekiwane zniknięcie części witryny. Przyczyna: błędna reguła. Naprawa: przywróć poprzednią wersję pliku i zmieniaj go po jednej regule, z testem po każdej.

Checklista pre/post-migracja dla sklepu (i co dalej)

Przed migracją:

  • Sprawdź indeksowalność produktów i kategorii.
  • Upewnij się, że staging ma noindex, a produkcja nie.
  • Zweryfikuj przekierowania HTTPS i canonicale.
  • Przejrzyj robots.txt i sitemapę.
  • Zapisz stan wyjściowy w Search Console.

Po migracji:

  • Sprawdź GSC → Inspekcja URL → Test na żywo.
  • Wykonaj curl -I na kilku kluczowych URL-ach.
  • Sprawdź raport indeksowania pod kątem statusów noindex.
  • Zweryfikuj, czy boty AI mają dostęp do strony.
  • Ustaw monitoring widoczności w AI.

Co dalej:

Gdy indeksacja działa, warto zadbać o to, co dzieje się później. Semly monitoruje cytowania w AI i pokazuje, czy Twoja marka pojawia się w rekomendacjach modeli. Jeśli problem nie leży w noindex, sprawdź canonicale, treści renderowane tylko po stronie klienta (JS bez SSR) oraz reguły WAF i CDN, które mogą odcinać boty.

Sprawdź, czy AI widzi Twoją markę — zamów darmowy audyt w Semly i zobacz, jak wypadasz w odpowiedziach modeli AI. Wyniki nie są gwarantowane, bo zależą od branży, konkurencji i stanu wyjściowego.

FAQ

Czy robots.txt usuwa stronę z indeksu Google? Nie. Robots.txt blokuje crawling, nie indeksowanie. Strona zablokowana w robots.txt może nadal być w indeksie, jeśli linkują do niej inne witryny. Do usunięcia potrzebny jest noindex (przy dostępie dla bota) albo narzędzie Removals.

Czy noindex blokuje cytowanie w ChatGPT i Perplexity? Tak, pośrednio. Noindex usuwa stronę z indeksu, a modele AI w dużej mierze korzystają z indeksów wyszukiwarek. Osobna sprawa to blokada botów: zablokowanie GPTBot ogranicza trening, ale nie cytowanie. Za cytowanie odpowiadają OAI-SearchBot i PerplexityBot.

Jak szybko sprawdzić, czy strona ma przypadkowy noindex? Najszybciej przez curl -I https://twojadomena.pl (nagłówek X-Robots-Tag) oraz podgląd źródła strony (tag meta robots). Potem potwierdź w Search Console → Inspekcja URL → Test na żywo.

Źródła

Sprawdź, czy Cię widzi

Wpisz adres Twojej strony, żeby otrzymać bezpłatny raport widoczności w AI