Click Made Karolina Wcisło logo
Strona główna » Blog – projektowanie stron, grafika i eBooki | Click Made » Jak zablokować boty AI w WordPressie (GPTBot, robots.txt) i kiedy ma to sens

Jak zablokować boty AI w WordPressie (GPTBot, robots.txt) i kiedy ma to sens

Boty AI blokuje się w WordPressie przez plik robots.txt, dodając regułę Disallow: / dla konkretnych user-agentów (np. GPTBot, ClaudeBot, Google-Extended). Ale uwaga na najważniejszą rzecz: blokowanie bota od treningu modelu (GPTBot) to co innego niż blokowanie bota od wyszukiwania (OAI-SearchBot). Jeśli zablokujesz ten drugi, znikniesz z odpowiedzi ChatGPT. Dlatego najpierw zdecyduj, czego naprawdę chcesz, a dopiero potem edytuj plik.

Coraz częściej dostaję pytanie: „Karolina, czy te całe boty AI mogą mi po prostu podbierać treści ze strony? Da się to wyłączyć?”. Da się, i pokażę dokładnie jak. Ale zanim wkleisz pierwszą lepszą regułę z internetu, chcę, żebyś rozumiała jedną rzecz, bo to ona decyduje, czy zrobisz sobie dobrze, czy odetniesz się od klientów.

Ten artykuł jest praktycznym uzupełnieniem tekstu jak sprawić, żeby Twoja marka pojawiała się w odpowiedziach AI. Tam tłumaczę, jak być w odpowiedziach AI. Tu, jak świadomie się z nich wypisać, jeśli tego chcesz, i jak nie zrobić tego przez przypadek. Jeśli całe pojęcie optymalizacji pod AI jest dla Ciebie nowe, zacznij od przewodnika GEO i AEO, jak być polecanym przez AI.

Plik robots.txt jako punkt kontrolny dla botów AI w WordPressie - część botów wpuszczona, część zablokowana, co obrazuje selektywne, świadome blokowanie.

Czy w ogóle warto blokować boty AI?

Dla większości firm i specjalistów: raczej nie. Jeśli zależy Ci na tym, żeby AI polecało Twoją markę i cytowało Twoją stronę, blokowanie działa przeciwko Tobie. Blokada to świadomy wybór, nie bezpieczne ustawienie domyślne.

Blokowanie ma sens, gdy:

  • masz treści, których nie chcesz oddawać do trenowania modeli (autorskie materiały, płatne zasoby, bazy wiedzy),
  • chronisz prywatne sekcje strony (panele, strefy klienta, treści za logowaniem),
  • widzisz w logach, że jakiś bot zarzyna Ci serwer ruchem.

W pozostałych przypadkach blokada to po prostu rezygnacja z widoczności w miejscu, w którym Twoi klienci coraz częściej szukają. Jeśli dopiero budujesz stronę i chcesz, żeby była gotowa pod AI, a nie odcięta od niego, zerknij do tekstu o nowoczesnej stronie firmowej w 2026.

Trzy rodzaje botów AI, które musisz rozróżnić

To jest sedno całego tematu. Boty AI dzielą się na trzy grupy, które robią zupełnie co innego, i jedna reguła w robots.txt nie podejmie za Ciebie wszystkich trzech decyzji.

  1. Boty treningowe. Pobierają treści, żeby uczyć modele (np. GPTBot, ClaudeBot, Google-Extended, CCBot). Zablokowanie ich oznacza, że Twoje treści nie zasilą przyszłych wersji modeli. To decyzja o prawach do treści i prywatności.
  2. Boty wyszukiwania. Indeksują strony, żeby AI mogło je cytować w odpowiedziach na żywo (np. OAI-SearchBot, PerplexityBot, Claude-SearchBot). Zablokowanie ich oznacza, że znikasz z odpowiedzi danego asystenta. To decyzja o widoczności.
  3. Boty wywoływane przez użytkownika. Pobierają konkretną stronę, kiedy ktoś poprosi asystenta o jej otwarcie (np. ChatGPT-User, Perplexity-User). Zablokowanie ich blokuje akcję, o którą poprosił żywy człowiek. Prawie nigdy nie jest to dobry pomysł.

Najczęstszy błąd, jaki widzę: ktoś chce „chronić treści przed AI”, blokuje wszystko jak leci, i przy okazji wycina się z ChatGPT i Perplexity, czyli traci leady. Blokujesz trening, a zostawiasz wyszukiwanie? Jak najbardziej. Odwrotnie też. Ale trzeba to zrobić świadomie.

Najważniejsze boty AI i ich nazwy w 2026 roku

Reguła w robots.txt zadziała tylko wtedy, gdy nazwę user-agenta wpiszesz dokładnie tak, jak ogłasza się bot. Literówka („GPT-Bot” zamiast „GPTBot”) cicho psuje całą regułę. Oto najważniejsze nazwy:

  • OpenAI: GPTBot (trening), OAI-SearchBot (wyszukiwanie ChatGPT), ChatGPT-User (akcja użytkownika)
  • Anthropic (Claude): ClaudeBot (trening), Claude-SearchBot (wyszukiwanie), Claude-User (akcja użytkownika)
  • Google: Google-Extended (trening Gemini, to NIE jest zwykły Googlebot)
  • Perplexity: PerplexityBot (indeks), Perplexity-User (akcja użytkownika)
  • Common Crawl: CCBot (zasila wiele modeli)
  • Apple: Applebot-Extended (trening Apple Intelligence)
  • ByteDance: Bytespider (trening, znany z ignorowania reguł)
  • Meta: Meta-ExternalAgent
  • Amazon: Amazonbot

Lista zmienia się kilka razy w roku, więc po większych premierach modeli warto ją odświeżyć i sprawdzić w dokumentacji dostawcy.

Jak edytować robots.txt w WordPressie, krok po kroku

WordPress domyślnie generuje wirtualny plik robots.txt, którego nie ma fizycznie na serwerze. Masz trzy sposoby, żeby go nadpisać:

  1. Przez Yoast SEO (najprościej). Wejdź w Yoast SEO → Narzędzia → Edytor plików. Jeśli serwer pozwala na zapis, możesz tu stworzyć i edytować robots.txt bez dotykania FTP.
  2. Przez Rank Math. Rank Math → Ustawienia ogólne → Edytuj robots.txt.
  3. Fizyczny plik na serwerze. Wgraj plik robots.txt do głównego katalogu strony (przez menedżera plików hostingu lub FTP). Fizyczny plik ma pierwszeństwo przed wirtualnym.

Plik zawsze siedzi pod adresem twojadomena.pl/robots.txt, a zmiany wchodzą w życie przy kolejnym odwiedzeniu bota. Przy okazji edycji warto sprawdzić, czy masz w nim poprawnie podpiętą mapę strony, o czym piszę w tekście sitemap w robots.txt, czy dodawać.

Gotowe reguły do wklejenia

Wariant A. Blokuję trening, ale zostaję w odpowiedziach AI (rozsądny wybór, jeśli chronisz treści, ale chcesz leadów):

# Blokuj boty treningowe
User-agent: GPTBot
Disallow: /

User-agent: ClaudeBot
Disallow: /

User-agent: Google-Extended
Disallow: /

User-agent: CCBot
Disallow: /

# Zostaw boty wyszukiwania (żeby AI mogło Cię cytować)
User-agent: OAI-SearchBot
Allow: /

User-agent: Claude-SearchBot
Allow: /

User-agent: PerplexityBot
Allow: /

Wariant B. Blokuję wszystko, co się da (gdy świadomie nie chcesz mieć nic wspólnego z AI):

User-agent: GPTBot
Disallow: /

User-agent: OAI-SearchBot
Disallow: /

User-agent: ChatGPT-User
Disallow: /

User-agent: ClaudeBot
Disallow: /

User-agent: Claude-SearchBot
Disallow: /

User-agent: Google-Extended
Disallow: /

User-agent: PerplexityBot
Disallow: /

User-agent: CCBot
Disallow: /

User-agent: Bytespider
Disallow: /

User-agent: Applebot-Extended
Disallow: /

Każdy bot potrzebuje własnej reguły. Zezwolenie dla ClaudeBot nie zezwala automatycznie Claude-SearchBot, to trzeba wypisać osobno.

Ważny mit: blokada Google-Extended a Twoja pozycja w Google

Tu giną nawet doświadczeni. Zablokowanie Google-Extended nie usuwa Cię z wyszukiwarki Google ani z AI Overviews. Google-Extended to osobny token, który dotyczy tylko trenowania Gemini i Vertex AI. Twoje indeksowanie w Google robi Googlebot, którego nigdy nie blokujesz, bo to oznaczałoby zniknięcie z wyników wyszukiwania.

Innymi słowy: nie istnieje osobny bot „od AI Overviews”. Overviews korzystają z normalnego indeksu Google. Jedyny sposób, żeby się z nich wypisać, to wypaść z Google w ogóle, czego raczej nie chcesz.

Czy sam robots.txt wystarczy?

Nie zawsze. robots.txt to prośba, nie blokada techniczna. Grzeczne boty (OpenAI, Anthropic, Google) ją respektują. Ale część crawlerów, jak Bytespider czy czasem boty Perplexity, potrafi ją ignorować. Jeśli naprawdę chcesz coś odciąć, potrzebujesz reguły na poziomie serwera lub firewalla, na przykład w Cloudflare (Rules → block po user-agencie).

I jeszcze jedna pułapka, która ostatnio cicho odcina ludzi od AI: niektóre wtyczki SEO oraz Cloudflare mają przełącznik „Block AI Bots”, który bywa włączony domyślnie. Po aktualizacji wtyczki potrafisz z dnia na dzień zniknąć z ChatGPT, Claude i Perplexity, nawet o tym nie wiedząc. Zajrzyj do ustawień i sprawdź, czy nie blokujesz botów, na których Ci zależy. Jak na bieżąco sprawdzać, czy nadal pojawiasz się w odpowiedziach AI, opisuję w tekście AI Overviews, cytowania i monitoring.

A co z plikiem llms.txt?

llms.txt to osobny temat i nie służy do blokowania. To propozycja standardu, która ma wskazywać modelom najważniejsze treści, a nie ograniczać dostęp. Kiedy ma sens, a kiedy to tylko moda, rozkładam na czynniki w tekście llms.txt, kiedy ma sens i jak wdrożyć.

FAQ

Czy blokada GPTBot zaszkodzi mojej pozycji w Google?

Nie. GPTBot to crawler OpenAI i nie ma nic wspólnego z Googlebot. Blokada Google-Extended też nie wpływa na wyniki Google, dotyczy tylko trenowania Gemini.

Zablokowałam wszystkie boty AI. Czy zniknę z ChatGPT?

Jeśli zablokowałaś OAI-SearchBot, to z wyszukiwania ChatGPT tak. Żeby zostać w odpowiedziach, a wypisać się tylko z treningu, zostaw boty wyszukiwania, a zablokuj tylko treningowe (wariant A wyżej).

Czy robots.txt na pewno zatrzyma każdego bota?

Nie. To prośba, którą grzeczne boty respektują, a część crawlerów ignoruje. Do twardego odcięcia potrzebna jest reguła na serwerze lub w Cloudflare.

Mam WordPress bez fizycznego robots.txt. Jak go edytować?

Najprościej przez Yoast SEO (Narzędzia → Edytor plików) albo wgrywając własny plik do katalogu głównego strony.

Jak sprawdzić, czy reguły działają?

Otwórz twojadomena.pl/robots.txt w przeglądarce i sprawdź, czy widzisz swoje reguły. Możesz też zajrzeć w logi serwera i poszukać nazw botów, żeby zobaczyć, kto faktycznie wchodzi.

Karolina Wcisło

Autor

Karolina Wcisło

Projektantka stron internetowych i materiałów graficznych. Od ponad 10 lat tworzę strony na WordPressie dla firm i specjalistów — zdalnie, dla klientów z całej Polski. Prowadzę jednoosobowe studio graficzno-webowe Click Made.

Najnowsze artykuły

© 2026 Click Made Karolina Wcisło. Wszystkie prawa zastrzeżone.
Strony internetowe · Identyfikacja wizualna · eBooki · Prezentacje