Cloudflare domyślnie blokuje boty AI — nie znikaj z ChatGPT
Cloudflare domyślnie blokuje boty AI na wielu stronach — jeśli nie sprawdzisz ustawień firewalla, Twoja marka może już nie istnieć w odpowiedziach ChatGPT czy Perplexity.
Co właściwie robi Cloudflare z botami AI?
Cloudflare daje właścicielom stron jedno kliknięcie, które blokuje boty AI zbierające treści — funkcję uruchomiono w 2024 roku (źródło).
Cloudflare to warstwa, przez którą przechodzi ruch do dużej części polskich stron. Zanim odwiedzający (albo bot) dotrze do Twojego serwera, przechodzi przez filtry Cloudflare. Jeśli tam włączona jest blokada botów AI, bot dostaje odmowę i nie widzi Twojej treści.
Kierunek jest jasny: Cloudflare przesuwa domyślne ustawienia w stronę blokowania. Dla Ciebie oznacza to jedno — musisz świadomie zdecydować, kogo wpuszczasz, bo „nic nie robię” może w praktyce znaczyć „blokuję”.
Dlaczego to jest problem dla widoczności w AI?
Jeśli bot AI nie pobierze Twojej strony, silnik generatywny (system, który odpowiada użytkownikowi gotowym tekstem zamiast listą linków — jak ChatGPT czy Perplexity) nie ma z czego Cię zacytować.
To nie teoria. Boty AI generują ogromny ruch. Analiza ruchu do sieci Cloudflare wskazała Bytespider, Amazonbot, ClaudeBot i GPTBot jako najważniejsze crawlery AI pod względem liczby żądań (Cloudflare, 2025, źródło). Skala tego ruchu jest realna: analiza Vercel i MERJ zarejestrowała 569 mln żądań GPTBota i 370 mln żądań bota Anthropic miesięcznie (Vercel + MERJ, 2024, źródło).
Wyobraź sobie kancelarię z Krakowa, która buduje pozycję eksperta od prawa spadkowego. Publikuje świetne poradniki. Ale jej strona stoi za Cloudflare z włączoną blokadą botów AI. Efekt: gdy klient pyta ChatGPT „jak wygląda dział spadku”, odpowiedź powstaje z treści konkurencji — bo tylko konkurencja wpuściła boty.

Który bot czego szuka? Nie wszystkie są takie same
To kluczowe rozróżnienie: „bot AI” to nie jedna rzecz. Każdy dostawca ma kilka różnych botów o różnych zadaniach. Jeden trenuje model, inny buduje indeks wyszukiwania, jeszcze inny pobiera stronę na żądanie konkretnego użytkownika.
| Bot | Co robi | robots.txt |
|---|---|---|
| GPTBot (OpenAI) | zbiera treści | respektuje token robots.txt |
| ChatGPT-User (OpenAI) | pobiera stronę na żądanie użytkownika | reguły robots.txt „mogą nie obowiązywać” |
| ClaudeBot (Anthropic) | trenowanie modelu | respektuje robots.txt |
| Claude-SearchBot (Anthropic) | indeks wyszukiwania Claude’a | respektuje robots.txt |
| PerplexityBot | indeksuje treści do wyników | respektuje robots.txt |
| Perplexity-User | fetch na żądanie użytkownika | „generalnie ignoruje” robots.txt |
Anthropic deklaruje, że wszystkie jego boty respektują sygnały „do not crawl” zgodne ze standardem branżowym (Anthropic, 2026, źródło). W praktyce oznacza to, że blokada ClaudeBota wyklucza Twoje przyszłe materiały z treningu modelu, blokada Claude-SearchBota wyklucza Cię z indeksu wyszukiwania Claude’a, a blokada Claude-User zatrzymuje pobieranie treści w odpowiedzi na zapytanie użytkownika (Anthropic, 2026, źródło).
Ale uwaga na dwa boty pobierające treść na żądanie użytkownika. W rewizji dokumentacji z grudnia 2025 OpenAI usunęło deklarację, że ChatGPT-User respektuje robots.txt — dokumentacja mówi teraz wprost: „ponieważ te działania inicjuje użytkownik, reguły robots.txt mogą nie obowiązywać” (OpenAI, dostęp 2026, źródło). Podobnie Perplexity-User „generalnie ignoruje reguły robots.txt” (Perplexity, dostęp 2026, źródło). Ważne rozróżnienie po stronie Perplexity: sam PerplexityBot służy do wyników wyszukiwania i — jak deklaruje firma — nie zbiera treści do trenowania modeli (Perplexity, dostęp 2026, źródło).
Konsekwencja praktyczna: możesz zablokować bota trenującego model, a jednocześnie chcieć wpuścić bota indeksującego, który daje Ci cytowania. Blokada „na całość” wyrzuca Cię także z indeksu wyszukiwania silników generatywnych.
Jeśli nie wiesz, które boty widzą dziś Twoją stronę, a które dostają odmowę — sprawdź to w audycie widoczności w AI.
robots.txt to nie zamek. To karteczka na drzwiach
Ważny niuans, którego nie odkrywaj za późno: robots.txt nie blokuje nikogo technicznie. To prośba, nie zapora.
Cloudflare stwierdza wprost, że respektowanie robots.txt przez boty jest dobrowolne (Cloudflare, 2025, źródło). Bot może uszanować regułę albo ją zignorować. Firewall Cloudflare działa inaczej — technicznie odrzuca żądanie na poziomie sieci, zanim dotrze do Twojego serwera.
To dwie różne warstwy kontroli:
- robots.txt — prosisz boty, żeby czegoś nie pobierały. Grzeczne boty (jak ClaudeBot czy GPTBot) słuchają. Boty na żądanie użytkownika mogą zignorować.
- Cloudflare / firewall — technicznie blokujesz dostęp. Bot nie ma wyboru.
Dlatego decyzja w panelu Cloudflare jest ważniejsza niż wpis w robots.txt. Reguła w firewallu obowiązuje nawet te boty, które robots.txt ignorują. To jedyny sposób, żeby faktycznie zatrzymać bota, który deklaruje, że reguł „nie musi” przestrzegać — jak Perplexity-User czy ChatGPT-User.
Blokada botów AI to nie ustawienie „bezpieczeństwa”, które włączasz i zapominasz. To decyzja biznesowa: czy chcesz istnieć w odpowiedziach ChatGPT i Perplexity, czy nie.
Dlaczego nie wystarczy „po prostu wpuścić wszystkich”?
Bo skala pobierania rośnie szybciej niż jakikolwiek zwrot z tego ruchu. Crawling Perplexity wzrósł o +256,7% względem ruchu ludzkich użytkowników w okresie styczeń–lipiec 2025 (Cloudflare, 2025, źródło). Boty pobierają coraz więcej, a odsyłają coraz mniej realnych odwiedzin.
Stąd popularność blokad. Ale ślepa blokada „wszystkich botów AI” jest równie kosztowna, tylko w drugą stronę — tracisz cytowania i wzmianki marki w odpowiedziach.
Naszym zdaniem właściwa strategia to selekcja, nie zero-jedynka. Rozważ:
- Wpuść boty indeksujące (PerplexityBot, OAI-SearchBot, Claude-SearchBot) — to one dają Ci szansę na cytowanie.
- Rozważ blokadę botów trenujących (ClaudeBot do treningu, GPTBot), jeśli nie chcesz, by Twoje treści zasilały modele bez cytowania.
- Zdecyduj świadomie o botach na żądanie użytkownika — pamiętaj, że część z nich i tak zignoruje robots.txt, więc realną blokadę da Ci tylko firewall.
To decyzja zależna od tego, ile ważą dla Ciebie cytowania. Sklep na Allegro sprzedający przez własną stronę może chcieć maksymalnej widoczności w Perplexity. Firma usługowa B2B z unikalnym know-how może woleć chronić treści przed treningiem, ale zostać w indeksie.
Zwróć uwagę na różnicę deklaracji między dostawcami. Anthropic mówi wprost, że wszystkie jego boty honorują sygnały „do not crawl” (Anthropic, 2026, źródło). OpenAI w grudniu 2025 usunęło analogiczną deklarację dla ChatGPT-User (OpenAI, dostęp 2026, źródło). To pokazuje, dlaczego nie warto opierać strategii tylko na dobrej woli botów — deklaracje się zmieniają, i to w niekorzystną stronę.
Dodatkowa pułapka: treść renderowana przez JavaScript
Nawet jeśli wpuścisz boty, jest drugi próg. Treść renderowana wyłącznie po stronie klienta (przez JavaScript) jest niewidoczna dla głównych crawlerów AI (Vercel + MERJ, 2024, źródło).
W analizie ponad 500 milionów pobrań GPTBota nie znaleziono dowodów, że bot wykonuje JavaScript — pobiera pliki JS (11,50% jego żądań), ale ich nie uruchamia; ClaudeBot pobiera JS w 23,84% żądań, także bez wykonania (Vercel + MERJ, 2024, źródło). Wyjątkiem jest ekosystem Google (korzysta z infrastruktury renderującej Googlebota) i AppleBot.
Wniosek praktyczny: jeśli Twoja treść „doładowuje się” po wejściu na stronę i nie ma jej w źródle HTML, bot AI zobaczy pustą stronę — nawet jeśli Cloudflare go wpuścił. Sprawdź, czy najważniejsze treści są w HTML serwera, a nie budowane dopiero w przeglądarce.
FAQ
Najczęstsze pytania właścicieli stron o blokadę botów AI w Cloudflare — z krótkimi, konkretnymi odpowiedziami.
Jak sprawdzić, czy Cloudflare blokuje boty AI na mojej stronie?
Zaloguj się do panelu Cloudflare i sprawdź sekcję zarządzania botami oraz reguły firewalla. Szukaj włączonej opcji blokowania botów AI („AI bots”). Pamiętaj, że ustawienie może być domyślnie włączone — brak Twojej ingerencji nie znaczy „wpuszczam wszystkich”. Osobno sprawdź plik robots.txt pod adresem TwojaDomena.pl/robots.txt.
Czy zablokowanie botów AI usuwa mnie z ChatGPT i Perplexity?
Nie od razu, ale odcina dopływ świeżych treści. Silniki generatywne budują odpowiedzi z tego, co ich boty pobiorą. Jeśli PerplexityBot czy OAI-SearchBot dostają odmowę, Twoje nowe strony nie trafią do ich indeksu, a stare przestaną być aktualizowane. Z czasem znikasz z cytowań.
Czy sam wpis w robots.txt wystarczy, żeby zarządzać botami?
Nie w pełni. Cloudflare stwierdza, że respektowanie robots.txt jest dobrowolne (Cloudflare, 2025). Grzeczne boty, jak ClaudeBot, słuchają. Ale ChatGPT-User i Perplexity-User mogą go ignorować (dokumentacje OpenAI i Perplexity, 2026). Firewall Cloudflare działa technicznie i obejmuje także te boty.
Wpuściłem boty, ale nadal nie widzę cytowań — dlaczego?
Możliwe, że Twoja treść renderuje się przez JavaScript. Główne crawlery AI nie wykonują JS — nie znaleziono na to dowodów w ponad 500 mln pobrań GPTBota (Vercel + MERJ, 2024). Sprawdź, czy kluczowe treści są w źródłowym HTML strony, a nie doładowywane w przeglądarce.