Przejdź do treści
Robert Marczyński

ClaudeBot, Claude-SearchBot, Claude-User: czym się różnią

Krótka odpowiedź

Anthropic dokumentuje trzy aktywne boty o różnych zadaniach: ClaudeBot zbiera treści do trenowania modeli, Claude-SearchBot buduje indeks wyszukiwania Claude'a, a Claude-User pobiera strony na żądanie użytkownika w trakcie rozmowy. Blokada ClaudeBota nie usuwa strony z odpowiedzi; blokada dwóch pozostałych wycina ją z cytowań. W moim pomiarze z sierpnia 2026 żadna z 56 spółek GPW nie blokowała botów odpowiadających, a amerykańskie zestawienie ze snapshotu z czerwca 2026 pokazuje tam odwrotny obraz: ClaudeBota blokuje 38 ze 107 serwisów.

Robert Marczyński4 min czytania3 źródła

To trzy różne boty firmy Anthropic o trzech różnych zadaniach — i pomylenie ich przy pisaniu robots.txt kosztuje albo prywatność treści, albo widoczność w odpowiedziach Claude'a. Rozróżnienie w jednym spojrzeniu:

Bot Co robi Kiedy pobiera Co odbiera blokada
ClaudeBot zbiera treści do trenowania modeli systematycznie, z wyprzedzeniem obecność w danych treningowych przyszłych modeli
Claude-SearchBot buduje indeks wyszukiwania Claude'a systematycznie, z wyprzedzeniem obecność w indeksie, z którego powstają odpowiedzi
Claude-User pobiera stronę na żądanie użytkownika w chwili pytania, na życzenie człowieka doczytanie strony na żywo w trakcie rozmowy

W regułach spotyka się jeszcze anthropic-ai — starszą nazwę używaną historycznie dla zbierania danych treningowych; część serwisów blokuje ją równolegle z ClaudeBotem na wszelki wypadek.

Praktyczne konsekwencje

Jeśli chcesz być cytowany przez Claude'a: nie blokuj Claude-SearchBota ani Claude-User. Pierwszy decyduje, czy strona w ogóle jest w indeksie; drugi — czy Claude może ją doczytać, gdy użytkownik o nią zapyta. Blokada któregokolwiek wycina firmę z odpowiedzi.

Jeśli chcesz chronić treść przed treningiem: blokada ClaudeBota (i ewentualnie anthropic-ai) załatwia dokładnie to, nie ruszając widoczności w odpowiedziach na żywo. Anthropic dokumentuje, że boty honorują robots.txt. To samo rozróżnienie trening–odpowiedzi obowiązuje u innych dostawców — pełny rachunek opisałem przy GPTBocie.

Dwa rynki, dwie strategie

Ciekawie wygląda porównanie praktyk. W moim pomiarze 56 plików robots.txt spółek WIG20 i mWIG40 z sierpnia 2026 botów odpowiadających Anthropic nie blokował nikt, a ClaudeBota dwie spółki — obie gotowym blokiem reguł od Cloudflare, nie własną decyzją.

Na rynku amerykańskim jest odwrotnie: według snapshotu US Tech Automations ze 107 dużych serwisów z 13 czerwca 2026 ClaudeBota blokowało 38, a Claude-SearchBota 19, czyli 17,8% — tam wydawcy traktują treść jak produkt i bronią jej także kosztem widoczności. Dla polskiej firmy to raczej szansa niż wzór: pisałem o tym szerzej przy różnicach w cytowaniu między Claude'em a ChatGPT — tam, gdzie wielcy się wycinają, robi się miejsce dla mniejszych, którzy zostali czytelni.

Jak sprawdzić własny plik

Jedna komenda pokazuje, czy któryś bot Anthropic jest u Ciebie wymieniony:

curl -sL https://twojadomena.pl/robots.txt | grep -i -A2 "claude"

Pusty wynik oznacza brak reguł — czyli dostęp dozwolony dla wszystkich trzech botów, bo w robots.txt ograniczenie powstaje wyłącznie przez jawny zakaz. Gotowe warianty pliku z poprawnymi tokenami znajdziesz we wzorze robots.txt dla botów AI.

Najczęstsze pytania

Co to jest ClaudeBot i skąd wziął się w logach mojego serwera?
ClaudeBot to crawler firmy Anthropic zbierający publicznie dostępne treści do trenowania modeli Claude. Pojawia się w logach, bo systematycznie odwiedza strony jak każdy robot indeksujący; przedstawia się nazwą ClaudeBot w nagłówku User-Agent. Jego wizyty nie oznaczają, że ktoś właśnie pyta o Twoją firmę — to zbieranie danych na przyszłość. Za odpowiedzi na żywe pytania odpowiadają dwa inne boty: Claude-SearchBot i Claude-User.
Czym różni się Claude-SearchBot od Claude-User?
Momentem i celem pobrania. Claude-SearchBot buduje z wyprzedzeniem indeks wyszukiwania, z którego Claude korzysta przy odpowiadaniu — działa jak crawler wyszukiwarki. Claude-User pobiera konkretną stronę w chwili, gdy użytkownik w rozmowie prosi o coś, co wymaga zajrzenia do sieci — działa na bezpośrednie żądanie człowieka. Blokada pierwszego usuwa stronę z indeksu, blokada drugiego uniemożliwia doczytanie jej na żywo; obie kosztują cytowania.
Czy zablokowanie ClaudeBota usunie moją stronę z odpowiedzi Claude'a?
Nie wprost. ClaudeBot zbiera dane treningowe, więc jego blokada oznacza, że treść nie zasili przyszłych modeli — ale strona pozostaje osiągalna dla odpowiedzi budowanych na żywo, dopóki Claude-SearchBot i Claude-User mają dostęp. Według dokumentacji Anthropic na sierpień 2026 boty honorują robots.txt, a starsza nazwa anthropic-ai bywa wciąż używana w regułach jako dodatkowy token treningowy.
Czy polskie strony blokują boty Anthropic?
W czołówce giełdowej praktycznie nie: w moim pomiarze 56 plików robots.txt spółek WIG20 i mWIG40 z sierpnia 2026 Claude-SearchBota i Claude-User nie blokował nikt, a ClaudeBota — dwie spółki, w obu przypadkach gotowym blokiem reguł. Na rynku amerykańskim proporcje są inne: według snapshotu US Tech Automations z 13 czerwca 2026 ClaudeBota blokowało 38 ze 107 badanych dużych serwisów, a Claude-SearchBota 19, czyli 17,8%.

Źródła

Dane zewnętrzne przywołane w tekście mają tu swoje źródła.

  1. Anthropic — dokumentacja crawlerów: role ClaudeBot, Claude-User i Claude-SearchBot oraz skutki blokowania (nowa karta)
  2. US Tech Automations — Who Blocks Anthropic ClaudeBot: snapshot robots.txt 107 serwisów (13.06.2026) (nowa karta)
  3. Badanie własne — robots.txt 56 spółek GPW (pomiar 10⁠–⁠11.08.2026) (nowa karta)

Udostępnij

Powiązane

Masz konkretny proces do omówienia?

Napisz, jaki to proces i ile razy w miesiącu się powtarza. Odpowiem, czy nadaje się do automatyzacji, również wtedy, gdy odpowiedź brzmi „nie warto”.

Albo prosto na adres: not-a-bot@ekspertodsztucznejinteligencji.pl