6 sierpnia 2026, poniedziałkowe popołudnie
Liczyłem linki. Znalazłem trzy strony, których serwer odsyłał roboty AI.
Robiłem coś zupełnie innego. Zastanawialiśmy się nad menu doklejanym skryptem, więc liczyłem, ile linków widzi na stronie głównej robot, który skryptów nie odpala. Dziewięć adresów, dziesięć minut, nudna robota.
Gabinet weterynaryjny pokazał zero linków. Salon wykończeń wnętrz — też zero. Przeglądarce te same strony oddawały trzynaście i dziewiętnaście.
Zero linków to nie jest „mało linków”. Zero linków to jest „nie dostałem strony”.
$ curl -A "GPTBot" https://gabinet-weterynaryjny.pl → 403 $ curl -A "ClaudeBot" https://gabinet-weterynaryjny.pl → 403 $ curl -A "PerplexityBot" https://gabinet-weterynaryjny.pl → 403 $ curl -A "Googlebot" https://gabinet-weterynaryjny.pl → 200 $ curl https://gabinet-weterynaryjny.pl → 200
Ten sam adres, ta sama minuta. Jedyna różnica jest w imieniu, którym się przedstawiamy. Kod 403 znaczy „odmawiam”, kod 200 znaczy „proszę bardzo”.
U pogotowia wod-kan było podobnie, ale tylko dla ClaudeBota — GPTBot i Perplexity wchodziły tam normalnie. Ta różnica jest ważna i dlatego jest tu napisana osobno, a nie schowana w zbiorczym zdaniu.
| Firma | GPTBot | ClaudeBot | PerplexityBot | Googlebot |
|---|---|---|---|---|
| gabinet weterynaryjny | 403 | 403 | 403 | 200 |
| salon wykończeń wnętrz | 403 | 403 | 403 | 200 |
| pogotowie wod-kan 24h | 200 | 403 | 200 | 200 |
| pozostałych sześć firm | 200 | 200 | 200 | 200 |
Przesuń tabelę w bok →
Pomiar 2026-08-09, prawdziwe zapukanie pod adres, nie odczyt deklaracji z pliku. Trzy firmy odsyłały roboty AI błędem 403. Dwie z nich blokowały wszystkie trzy roboty naraz. Trzecia blokowała wyłącznie ClaudeBota — GPTBot i Perplexity dostawały u niej 200.
Dlaczego nikt o tym nie wiedział
Nasza kontrola sprawdzała robots.txt. Wszystkie trzy strony mają w nim grzeczne
User-agent: * / Allow: /, więc narzędzie meldowało zielone „w porządku”
dla wszystkich dziewięciu firm. Podręcznikowy cichy fałszywy sukces: system mówi
„sprawdzone, wszystko gra”, a trzech klientów jest dla ChatGPT fizycznie nie do pobrania.
Skąd ta blokada
Nie z naszych plików. Sprawdziliśmy przez FTP: w .htaccess obu stron nie ma ani
jednej reguły po User-Agent. Kod 403 generuje serwer. Te dwie firmy stoją u innego operatora
niż reszta, a blokada robotów AI jest tam włączona domyślnie. Nikt jej nie włączał.
Czy da się to obejść
Sprawdziliśmy 7 sierpnia na jednym kliencie, z kopią zapasową i automatycznym cofnięciem. Reguła jawnie przepuszczająca te roboty nie zmieniła nic: 403 przed, 403 po, 403 po cofnięciu. Blokada działa wyżej, niż sięgają nasze pliki. Zostaje zgłoszenie u operatora — i to jest cała prawda o tym punkcie.
Można było napisać sto idealnych akapitów pod cytowanie w ChatGPT. Robot nie dochodził do akapitów.
Robots.txt to prośba, nie przepustka. I nikt tego nie sprawdza, dopóki nie zapuka.
Cztery kody odpowiedzi Twojego serwera, z datą i godziną pomiaru.
Co Puchacz robi
Puka naprawdę, zamiast wierzyć na słowo. GPTBot, ClaudeBot, PerplexityBot — i osobno Googlebot, żeby odróżnić „strona padła” od „blokują tylko AI”. Gdy roboty AI dostają 403, a Googlebot 200, to nie jest awaria. To jest blokada wymierzona w AI i naprawia się ją zupełnie inaczej.
Liczy, ile linków widzi robot, który nie odpala skryptów. Brzmi jak drobiazg, a jest testem, czy model ma z czego zbudować obraz Twojej firmy. U lakierni proszkowej menu i stopka były wstrzykiwane JS-em: Google widział wszystko, roboty AI widziały dziesięć linków. Po naprawie — czterdzieści cztery.
Czyta robots.txt i sprawdza dwanaście robotów po nazwie, w trzech klasach ważności. Zablokowany robot z klasy „miło mieć” to informacja, nie alarm. Nie straszymy Cię czymś, co Cię nie wyrzuca z AI.
Porównuje z poprzednim pomiarem i krzyczy przy regresji. Gdyby ktoś przywrócił stary robots.txt po WordPressie, blokujący GPTBota, dowiemy się nazajutrz, a nie przypadkiem za pół roku.
Nieudany pomiar nie nadpisuje dobrego. Gdy nie ma łączności, zapisujemy „nie wiem” i zostawiamy ostatni prawdziwy wynik. „Nie wiem” nigdy nie udaje „jest dobrze”. Ta zasada powstała po konkretnej wpadce, opisanej wyżej.
Liczy ruch z asystentów AI osobnym raportem z Google Analytics. Nie z gotowego kanału, bo sesja z chatgpt.com otagowana naszym własnym parametrem wpada u Google do „Unassigned” i w gotowym kanale jej nie ma. Zero sesji zapisujemy jako zero, bo to poprawny wynik, a nie błąd pomiaru.
Sprawdza dane strukturalne na żywej stronie: czy jest JSON-LD, jakiego typu, czy ma nazwę, telefon i adres, czy telefon zgadza się z tym, co masz w wizytówce.
Ile linków widzi robot, który nie odpala skryptów
| Firma | Linków bez JS | Uwaga |
|---|---|---|
| lakiernia proszkowa | 44 | po naprawie; wcześniej 10 |
| krioterapia | 40 | — |
| pogotowie wod-kan 24h | 25 | — |
| atrakcje weselne | 23 | — |
| drewniane place zabaw | 19 | — |
| gabinet weterynaryjny | 13 | przeglądarce; robotom AI oddaje 403 |
| fotograf i kamerzysta | 4 | ten sam problem co u lakierni, jeszcze niezałatany |
| nasza własna strona | 1 | ten sam problem, jeszcze niezałatany |
Przesuń tabelę w bok →
Pomiar 2026-08-09. Próg, który sobie postawiliśmy, to piętnaście linków w surowym HTML. Dwa ostatnie wiersze są nasze i naszego klienta — zostawiamy je tu, bo to ta sama usterka, którą u kogoś innego już naprawiliśmy.
Zła wiadomość, którą mówimy sami
Ruch z asystentów AI jest dziś mały
U wszystkich naszych klientów razem to 21 sesji przez 28 dni. Wszystkie z ChatGPT. Sprawdzamy to nie dlatego, że dziś to duży kanał, tylko dlatego, że zamknięte drzwi zostają zamknięte, dopóki ktoś ich nie otworzy.
Gdyby ktoś sprzedawał Ci dziś „ruch z AI” jako kanał sprzedażowy, pokaż mu tę tabelę i poproś o jego własną.
| Firma | Sesje z AI | Wszystkie sesje | Udział |
|---|---|---|---|
| drewniane place zabaw | 9 | 1077 | 0,84% |
| salon wykończeń wnętrz | 8 | 751 | 1,07% |
| gabinet weterynaryjny | 2 | 77 | 2,6% |
| fotograf i kamerzysta | 1 | 71 | 1,41% |
| pogotowie wod-kan 24h | 1 | 37 | 2,7% |
| pozostałe trzy firmy | 0 | — | 0% |
Przesuń tabelę w bok →
GA4, osobny filtrowany raport, 28 dni do 9 sierpnia 2026. Zero zapisujemy jako zero.
Czego Puchacz nie robi
Najdłuższa taka lista w całej Ostoi. Ten moduł ma najładniejszą nazwę i najwęższą obietnicę.
Nie monitoruje, czy AI Cię wymienia. To osobny produkt, rynek sprzedaje go od 353 zł w górę i my go dziś nie mamy. Sprawdzamy, czy AI może Cię pobrać. Kiedy pomiar wzmianek ruszy u nas automatem, dopiszemy to do oferty. Nie wcześniej.
Nie odblokuje Twojego hostingu. Sprawdzone doświadczalnie, opis wyżej: 403 przed, 403 po, 403 po cofnięciu. Prowadzimy sprawę u operatora i pilnujemy jej, pomagamy napisać zgłoszenie. Słowa „naprawiamy” tu nie ma.
Puka do strony głównej, nie do każdej podstrony. Blokada założona na jeden katalog nam umknie. Wiemy o tym i piszemy to, zanim zapytasz.
Nie wie, czy wejście z ChatGPT to cytowanie w odpowiedzi, czy ktoś wkleił link znajomemu. Google Analytics pokazuje wyłącznie źródło ruchu. Z tego nie da się wyliczyć, ile razy AI Cię poleciło.
Nie ma llms.txt ani niczego w tym rodzaju. Jeśli ktoś zapyta —
nie robimy tego.
Jedno pytanie, na które odpowiem tego samego dnia
Czy Twój serwer wpuszcza roboty ChatGPT, Claude'a i Perplexity. Do sprawdzenia nie potrzebuję dostępu do niczego — wystarczy adres strony.
Sprawdź, czy ChatGPT może pobrać Twoją stronęJeśli wszystko jest w porządku, napiszę to jednym zdaniem i nie będę Ci niczego sprzedawał.
Moduł pierwszy
Ryś — indeksacja
Sprawdza każdy adres ze spisu i przy każdej brakującej stronie podaje powód słowami Google.
Cała historia, dłużej
Trzy strony, które odsyłały roboty AI
Jak wyszło, co sprawdziliśmy, co nie zadziałało i co zrobić, jeśli to Twoja strona.
Nazwy robotów i sposób ich identyfikacji podają sami dostawcy: OpenAI oraz Anthropic.
Gwarancja 30 dni — na naszą robotę, nie na decyzję Google
Jeśli w ciągu trzydziestu dni nie dostaniesz od nas tego, co opisaliśmy — pomiaru z datą, powodu przy każdej brakującej stronie i listy zadań w kolejności — oddajemy pieniądze. Czego nie obiecujemy: że Google na pewno zaindeksuje konkretną podstronę. Tej decyzji nie podejmujemy my.