TL;DR Samo logowanie nie ukrywa treści przed Google ani przed AI. Blokują dopiero
noindex, wpisy w robots.txt, brak treści w surowym HTML i przekierowania. Publicznie zostaw: opisy produktów, ceny, dostępność, specyfikacje, FAQ, dane firmy, blog i polityki. Za logowaniem schowaj: cenniki B2B, panele klienta i pliki do pobrania. Boty AI dzielą się na treningowe (GPTBot, ClaudeBot) i wyszukiwawcze (OAI-SearchBot, Claude-SearchBot, PerplexityBot). Blokada tych drugich odcina Cię od cytowań. Semly.ai pomaga sprawdzić, co realnie widzą Google i modele AI, i uporządkować dane, które trafiają do rekomendacji.
Treści za logowaniem w WordPressie — co naprawdę widzi Google i AI
Zacznijmy od najczęstszego nieporozumienia. Wielu właścicieli sklepów myśli, że skoro jakaś treść jest za logowaniem, to wyszukiwarki i modele AI jej nie widzą. To nieprawda.
Logowanie samo w sobie niczego nie blokuje. Blokują konkretne decyzje techniczne:
noindexw kodzie strony,- wpisy w robots.txt,
- brak treści w surowym HTML (bo ładuje się dopiero przez JavaScript),
- przekierowania, które prowadzą bota w miejsce bez treści.
Warto rozdzielić dwie rzeczy: crawl i indeksację. Crawl to moment, w którym bot pobiera stronę. Indeksacja to decyzja, czy trafi ona do wyników. Możesz pozwolić na crawl, a mimo to zablokować indeksację. I odwrotnie.
Jest jeszcze jedna pułapka. robots.txt to prośba, nie twarda reguła. Jeśli zablokujesz adres w robots.txt, bot go nie odwiedzi, ale sam adres i tak może pojawić się w wynikach, tyle że bez opisu. Do ukrywania stron służy noindex, a nie robots.txt.
Tabela botów AI: kto po co przychodzi
| Typ bota | Przykłady | Po co przychodzi |
|---|---|---|
| Treningowe | GPTBot, ClaudeBot, Google-Extended | Zbierają dane do trenowania modeli |
| Wyszukiwawcze | OAI-SearchBot, Claude-SearchBot, PerplexityBot | Budują indeks do odpowiedzi w czasie rzeczywistym |
| Na żądanie użytkownika | ChatGPT-User | Odwiedza stronę, gdy użytkownik o coś poprosi |
Najważniejsze: blokada bota treningowego nie blokuje wyszukiwawczego. Możesz powiedzieć "nie trenuj na moich treściach", a jednocześnie pozwolić, żeby ChatGPT Search cytował Twoją ofertę. Wiele firm blokuje wszystko hurtem i traci cytowalność, o którą właśnie walczy — zobacz, jak skłonić ChatGPT do rekomendowania Twojej firmy.
Na co uważać: 401 vs 200 Google zaleca kod 401 dla stron za logowaniem. W praktyce większość wtyczek membership zwraca 200 i przekierowuje na stronę logowania. Bot widzi wtedy pustą stronę logowania zamiast treści, którą chciałeś pokazać. To najczęstsza cicha przyczyna problemów z indeksacją.
Co udostępnić publicznie, a co zostawić za logowaniem
To pytanie sprowadza się do jednej zasady: pokaż to, co pomaga klientowi podjąć decyzję. Reszta może zostać za logowaniem.
Publicznie:
- opisy produktów i usług,
- ceny i dostępność,
- specyfikacje i parametry,
- FAQ,
- dane firmy (NIP, adres, kontakt),
- blog ekspercki,
- polityki (zwroty, dostawa, prywatność).
Za logowaniem:
- cenniki B2B i warunki dla partnerów,
- panele klienta i strefy konta,
- pliki do pobrania i materiały premium,
- treści szkoleniowe dla subskrybentów.
Dlaczego to działa? Bo AI buduje odpowiedź z tego, co znajdzie publicznie. Jeśli model nie widzi ceny, dostępności ani opisu, nie ma z czego zbudować rekomendacji. Zostaje mu ogólnik albo pominięcie Twojej marki. Więcej o tym, jak sprawić, by AI mówiło o Twoim sklepie, piszemy w osobnym poradniku.
Czy cena musi być publiczna? Nie zawsze, ale bardzo pomaga. Jeśli nie chcesz pokazywać cen detalicznych, pokaż przynajmniej zakres lub sposób wyceny. Model potrzebuje punktu zaczepienia.
Czy możesz ukryć cennik B2B? Tak. To normalna praktyka i nie szkodzi widoczności, o ile publiczna część oferty jest kompletna. Pamiętaj tylko, żeby nie udostępniać treści płatnych wbrew regulaminom ani nie obchodzić zabezpieczeń. Chodzi o mądre odsłonięcie tego, co i tak chcesz pokazać.
Krok po kroku: jak to wdrożyć w WordPressie
Krok 1 — Sprawdź, co widzą boty
Użyj curl -A z user-agentem Googlebota i OAI-SearchBot. Porównaj odpowiedzi.
curl -A "Googlebot" https://twojadomena.pl/produkt/example
curl -A "OAI-SearchBot" https://twojadomena.pl/produkt/example
Cel: ustalić, czy treść jest w surowym HTML, czy dopiero doczytuje ją JavaScript.
Punkt kontrolny: w odpowiedzi widzisz opis, cenę i dostępność. Jeśli widzisz pusty szkielet, masz problem z renderowaniem.
Krok 2 — Sprawdź ustawienia wtyczki membership
Przejrzyj MemberPress, Paid Memberships Pro albo WooCommerce Memberships. Sprawdź, czy nie dodają noindex i czy nie blokują stron w sitemap.
Punkt kontrolny: publiczne produkty są w sitemap i nie mają noindex. Typowy objaw błędu: strona zniknęła z Google po włączeniu wtyczki.
Krok 3 — Uporządkuj robots.txt
Nie blokuj botów wyszukiwawczych AI. Zostaw otwarte OAI-SearchBot, Claude-SearchBot i PerplexityBot.
Punkt kontrolny: w robots.txt nie ma reguł blokujących te boty. Typowy objaw błędu: brak cytowań w ChatGPT mimo dobrej widoczności w Google.
Krok 4 — Oznacz treści gated
Dla paywalla użyj isAccessibleForFree: false i hasPart z cssSelector. Dla paneli klienta i stref B2B zastosuj neutralne oznaczenie zakresu.
Punkt kontrolny: walidator schema nie zgłasza błędów, a oznaczenie zgadza się z tym, co faktycznie widać. Bez tego Google może uznać treść za cloaking.
Krok 5 — Dodaj JSON-LD
Wdróż Product/Offer, Organization i FAQPage. Pilnuj spójnych @id i sameAs. Pomocny w tym jest poradnik o linkowaniu wewnętrznym i bazie wiedzy w WordPressie.
Punkt kontrolny: encje łączą się w jedną spójną całość, a dane firmy są identyczne w schema i na stronie. Uczciwie: schema pomaga w parsowaniu i rich results, ale nie gwarantuje cytowań.
Krok 6 — Zadbaj o szybkość
Trzymaj się progów Core Web Vitals: LCP poniżej 2,5 s, INP poniżej 200 ms, CLS poniżej 0,1.
Punkt kontrolny: PageSpeed Insights pokazuje zielone pola dla kluczowych stron. Wolna strona traci i konwersję, i renderowanie.
Krok 7 — Sprawdź llms.txt
Yoast i AIOSEO generują go automatycznie. Wskaż w nim publiczne zasoby — dobre praktyki opisujemy w materiale o linkowaniu wewnętrznym dla GEO i AEO.
Punkt kontrolny: plik istnieje i prowadzi do realnych, publicznych treści. Traktuj go jako uzupełnienie, nie zamiennik robots.txt.
Najczęstsze błędy i jak je naprawić
Błąd: blokada wszystkich botów AI "na wszelki wypadek". Objaw: brak cytowań w ChatGPT i Claude. Naprawa: rozdziel trening od wyszukiwania i odblokuj boty wyszukiwawcze.
Błąd: noindex dodany globalnie przez wtyczkę.
Objaw: publiczne strony znikają z Google.
Naprawa: wyłącz noindex dla stron publicznych, zostaw go tylko tam, gdzie naprawdę potrzebny.
Błąd: brak treści w HTML, bo wszystko ładuje JavaScript. Objaw: boty widzą pustą stronę. Naprawa: włącz SSR albo prerendering dla kluczowych stron.
Błąd: schema bez spójnych encji.
Objaw: dane się rozjeżdżają, rich results nie działają.
Naprawa: ujednolić @id i sameAs w całym serwisie.
Błąd: traktowanie llms.txt jako silver bullet. Objaw: brak efektów mimo wdrożenia pliku. Naprawa: potraktuj go jako jeden element układanki, nie całe rozwiązanie.
Co dalej — jak mierzyć efekty i co poprawiać
Wdrożenie to dopiero początek. Teraz warto patrzeć na to, co realnie się dzieje.
Mierz widoczność w AI. Przydają się tu wskaźniki takie jak Visibility Score, Citation Rate i Share of Voice. Sprawdzaj logi serwera, żeby zobaczyć, które boty faktycznie wchodzą na stronę. Odświeżaj treści, bo modele chętniej sięgają po aktualne i kompletne informacje. Praktyczne wskazówki znajdziesz na blogu Semly o AI w SEO i e-commerce.
Daj sobie realistyczne ramy: 30, 60 i 90 dni. Efekty w AI są korelacyjne, nie gwarantowane. Nikt rozsądny nie obieca Ci konkretnej pozycji.
Jeśli masz dużo treści premium, rozważ osobny publiczny hub z opisami i FAQ. Wtedy klient i model AI mają co czytać, a Ty nie odsłaniasz tego, co ma zostać za logowaniem. To dokładnie ten mechanizm, który opisujemy w przewodniku o GEO dla sklepów e-commerce.
Tu naturalnie wchodzi Semly.ai. To polska platforma GEO dla e-commerce, która monitoruje widoczność w pięciu modelach AI, buduje bazę wiedzy dla LLM i integruje się między innymi z WooCommerce i WordPressem — sprawdź, jak wypromować swoją firmę w modelach AI. Plany startują od 199 zł/mc netto — pełne pakiety widoczności marki w AI znajdziesz w cenniku. Zamiast zgadywać, co widzą modele, dostajesz konkretny obraz i plan działania.
Checklista wdrożeniowa
- Sprawdzone odpowiedzi dla Googlebota i OAI-SearchBot
- Wtyczka membership bez przypadkowego
noindex - robots.txt bez blokad botów wyszukiwawczych
- Treści gated oznaczone poprawnie
- JSON-LD z spójnymi encjami
- Core Web Vitals w normie
- llms.txt wskazuje publiczne zasoby
- Włączony monitoring widoczności w AI
FAQ
Czy Google indeksuje treści za logowaniem?
Tak, jeśli bot ma dostęp do HTML. Logowanie samo w sobie nie blokuje indeksacji. Blokują noindex, robots.txt i brak treści w surowym kodzie.
Czy noindex ukryje stronę przed ChatGPT?
noindex działa głównie na wyszukiwarki. Boty AI mogą nadal pobrać stronę, jeśli mają dostęp. Jeśli chcesz kontrolować AI, użyj reguł dla konkretnych botów w robots.txt.
Czy blokada GPTBot wystarczy? Nie. GPTBot to bot treningowy. Widoczność w ChatGPT Search zależy od OAI-SearchBot. Blokując tylko GPTBot, nie odetniesz się od cytowań, ale też ich nie zyskasz. Więcej na ten temat przeczytasz w bazie wiedzy o widoczności w AI.
Czy llms.txt zastępuje robots.txt? Nie. To uzupełnienie, które wskazuje publiczne zasoby. robots.txt nadal odpowiada za dostęp botów, a llms.txt tylko porządkuje informacje.