Claude cytuje inaczej niż ChatGPT: dane z 379 tys. cytowań
Według analizy OtterlyAI z czerwca 2026, obejmującej 379 321 cytowań Claude w 16 406 domenach przy zapytaniach o oprogramowanie i technologie, 64% cytowań prowadzi do stron firmowych i produktowych, media to 14,9%, blogi 5,4%, a serwisy społecznościowe 0,9% — Reddit nie wystąpił ani razu. Pokrycie domen z ChatGPT wynosi ledwie 13%, więc widoczność w jednym silniku nie mówi prawie nic o widoczności w drugim. W tej próbie Claude nie ma zamkniętego klubu źródeł: dziesięć najczęściej cytowanych domen to 9,5% cytowań, a jedna trzecia domen pojawia się tylko raz — dla stron eksperckich i firmowych kanał wyraźnie bardziej otwarty niż pierwsza strona klasycznych wyników.
Robert Marczyński6 min czytania6 źródeł
Dlaczego w ogóle patrzeć na Claude osobno
W rozmowach o widoczności w AI „bycie cytowanym” traktuje się zwykle jak jedną dyscyplinę. Dane mówią co innego: to kilka osobnych konkurencji z różnymi zasadami.
Najlepszy dostępny pomiar dla Claude opublikował w czerwcu 2026 OtterlyAI: 379 321 cytowań z odpowiedzi Claude na zapytania o oprogramowanie i technologie, w 16 406 domenach, zebranych przez pełny miesiąc. Zastrzeżenie metodyczne od razu: to próba z jednej kategorii tematycznej, z narzędzia firmy, która sprzedaje monitoring widoczności. Liczby są w źródle policzalne i spójne, ale ich zasięg to zapytania o software, nie cały internet.
Z tym zastrzeżeniem — rozkład jest wyrazisty aż do przesady.
Co pokazują liczby
64% cytowań prowadzi do stron firmowych i produktowych. Nie do mediów, nie do agregatorów — do domen, na których firmy same opisują, co robią. Media to 14,9%, blogi 5,4%.
Serwisy społecznościowe: 0,9%. Reddit: zero. Ani jednego cytowania na 379 tysięcy. Dla porównania: według opublikowanej 26 czerwca 2026 analizy Semrush (126 mln amerykańskich promptów ze stycznia–kwietnia 2026, cztery platformy) ChatGPT cytuje średnio 15 źródeł na odpowiedź i opiera się mocno na Reddicie i Wikipedii. Ta sama treść, która pracuje na widoczność w ChatGPT przez obecność w dyskusjach, w Claude nie robi nic.
Nie ma zamkniętego klubu. Dziesięć najczęściej cytowanych domen to łącznie 9,5% cytowań, a 32,9% domen pojawia się w danych tylko raz. W wyszukiwarce klasycznej pierwsza strona wyników jest wąskim gardłem; tu ogon jest długi i otwarty.
Pokrycie z ChatGPT: 13% domen (na poziomie konkretnych adresów: 4,2%). Silniki odpowiedzi nie przepisują od siebie nawzajem. Widoczność mierzona w jednym nie przenosi się na drugi — i wnioski o „widoczności w AI” wyciągane z pomiaru jednej platformy są po prostu niedoważone.
Mechanika po stronie Claude
Trzy rzeczy, które tłumaczą ten rozkład i mają praktyczne skutki: dwie z oficjalnej dokumentacji Anthropic, trzecia z ustalenia o średniej pewności.
Po pierwsze, trzy osobne boty: ClaudeBot zbiera dane treningowe, Claude-User pobiera strony na żywo, gdy użytkownik zada pytanie, Claude-SearchBot buduje indeks pod jakość wyników. Anthropic pisze wprost, że blokada dwóch ostatnich odcina pobieranie i indeksowanie treści, a to — jak zastrzega dokumentacja — może obniżyć widoczność strony w wyszukiwaniu. Kto blokuje „boty AI” hurtem, wyłącza się z tego kanału w całości.
Po drugie, od wersji narzędzia wyszukiwania z 9 lutego 2026 Claude potrafi programistycznie filtrować wyniki, zanim je przeczyta: pisze i uruchamia kod, który odrzuca nieistotne strony przed włożeniem czegokolwiek do kontekstu. Zastrzeżenie, które trzeba zrobić: to opis narzędzia w API dla deweloperów, a Anthropic nie deklaruje, czy ten sam mechanizm stoi za wyszukiwaniem w aplikacji Claude, na której mierzył OtterlyAI. Dokumentacja opisuje sam mechanizm i cel — mniejsze zużycie tokenów przy zapytaniach z dużą liczbą wyników; o tym, jaka treść ten filtr przechodzi, nie mówi nic. Mój wniosek z praktyki jest taki, że wygrywa treść z odpowiedzią blisko nagłówka i z konkretnymi liczbami, a przegrywa ta, w której sedno mieszka w piątym akapicie. To zresztą ten sam wniosek, który wyprowadzam z mechaniki wybierania źródeł przez modele.
Po trzecie, zaplecze: wyszukiwanie Claude opiera się na indeksie Brave Search — to ustalenie o średniej pewności, wyprowadzone z listy podwykonawców Anthropic i zbieżności wyników, nie z deklaracji w dokumentacji. Praktycznie oznacza tyle, że obecność w indeksie Brave jest warunkiem wstępnym całej reszty.
Szansa, którą widać w robots.txt
Najciekawsza część tej układanki nie jest w danych OtterlyAI, tylko w plikach robots.txt dużych wydawców. Według odczytów z sierpnia 2026 boty Anthropic w całości blokują między innymi New York Times, Amazon i Guardian; zestawienie US Tech Automations ze snapshotu robots.txt z 13 czerwca 2026 wykazało, że spośród 107 badanych dużych serwisów 39, czyli 36,4%, blokuje co najmniej jednego crawlera Anthropic.
Dla indeksu liczy się jednak węższa liczba, bo wydawcy rozróżniają trening od wyszukiwania. W tym samym snapshocie ClaudeBota, który zbiera dane treningowe, blokuje 38 serwisów, a Claude-SearchBota, który buduje indeks wyszukiwania — 19, czyli 17,8%. To po tych dziewiętnastu zostaje pusta przestrzeń w indeksie, z którego Claude buduje odpowiedzi. Pozostałe blokady chronią treść przed treningiem, nie przed zacytowaniem.
Ten serwis jest po otwartej stronie tej granicy z premedytacją: robots.txt przepuszcza wszystkie boty, cała treść stoi w wysyłanym HTML — żadnego fragmentu nie dorenderowuje JavaScript — a teksty oparte na cudzych badaniach otwiera teza z liczbą i datą źródła. Nie dlatego, że Claude jest ważniejszy od Google — dlatego, że rachunek „kto czyta, ten może zacytować” działa u każdego dostawcy tak samo, a koszty poniesione raz pracują we wszystkich kanałach naraz.
Najczęstsze pytania
- Kogo najczęściej cytuje Claude?
- W analizie OtterlyAI z czerwca 2026 (379 321 cytowań przy zapytaniach o oprogramowanie i technologie) 64% cytowań prowadziło do stron firmowych i produktowych, 14,9% do mediów, 5,4% do blogów, a 0,9% do serwisów społecznościowych. Koncentracja jest niska: dziesięć najczęściej cytowanych domen odpowiada ledwie za 9,5% cytowań, a 32,9% domen pojawia się w danych tylko raz.
- Czy Claude cytuje Reddita?
- W badanej próbie — ani razu, na 379 321 cytowań. To najostrzejszy kontrast z ChatGPT, który według analizy Semrush opublikowanej 26 czerwca 2026 (dane: 126 mln amerykańskich promptów ze stycznia–kwietnia 2026) opiera odpowiedzi mocno na Reddicie i Wikipedii, cytując średnio 15 źródeł na odpowiedź. Miejsca, w których warto zabiegać o obecność, są więc różne dla różnych silników.
- Skąd Claude bierze wyniki wyszukiwania?
- Zaplecze wyszukiwania Claude opiera się na indeksie Brave Search — wskazuje na to lista podwykonawców Anthropic i zbieżność wyników, choć Anthropic nie opisuje tego wprost w dokumentacji, więc traktuję to jako ustalenie o średniej pewności. Praktyczny wniosek: obecność w indeksie Brave jest warunkiem wstępnym bycia znalezionym przez Claude.
- Jak sprawdzić, czy moja strona może być cytowana przez Claude?
- Po pierwsze robots.txt: Anthropic dokumentuje trzy boty i ostrzega, że blokada Claude-User albo Claude-SearchBot odcina pobieranie i indeksowanie treści, co według dokumentacji może obniżyć widoczność strony w wyszukiwaniu. Po drugie treść: od wersji narzędzia z lutego 2026 Claude potrafi programistycznie filtrować wyniki wyszukiwania, zanim je przeczyta — dokumentacja opisuje sam mechanizm, a ja wyprowadzam z niego wniosek, że strona z odpowiedzią blisko nagłówka i konkretnymi liczbami ma większe szanse przejść tę selekcję niż strona, w której sedno jest w piątym akapicie.
- Czy duże serwisy blokują boty Anthropic?
- Tak i to jest szansa dla mniejszych. Według odczytów robots.txt z sierpnia 2026 boty Anthropic w całości blokują między innymi New York Times, Amazon i Guardian, a według zestawienia US Tech Automations ze snapshotu z 13 czerwca 2026 co najmniej jeden crawler Anthropic blokuje 39 ze 107 badanych dużych serwisów, czyli 36,4%. Dla indeksu liczy się przy tym węższy podzbiór: ClaudeBota (trening) blokuje 38 serwisów, a Claude-SearchBota, odpowiadającego za indeks wyszukiwania — 19, czyli 17,8%. To po nich zostaje mniej konkurencji w odpowiedziach.
Źródła
Dane zewnętrzne przywołane w tekście mają tu swoje źródła.
- OtterlyAI — Claude AI Citation Study: 379 321 cytowań, 16 406 domen (czerwiec 2026)
- Anthropic — dokumentacja crawlerów i skutki ich blokowania (ClaudeBot, Claude-User, Claude-SearchBot)
- Anthropic — dokumentacja narzędzia web search (wersje, dynamic filtering)
- Semrush — AI Visibility Index: 126 mln amerykańskich promptów ze stycznia–kwietnia 2026 (publikacja 26.06.2026)
- US Tech Automations — Who Blocks Anthropic's ClaudeBot: 39 ze 107 serwisów (snapshot robots.txt z 13.06.2026)
- Simon Willison — Anthropic korzysta z Brave Search jako zaplecza wyszukiwania (21.03.2025)
Udostępnij
Powiązane
- Jak modele AI wybierają źródła, które cytująW badaniu na dziewięciu modelach żaden z jedenastu fikcyjnych ekspertów, umieszczonych w ponad 600 artykułach…
- Boty AI nie wykonują JavaScriptu. Co widzą zamiast stronyCrawlery asystentów AI — GPTBot, ClaudeBot, PerplexityBot i pokrewne — pobierają surowy HTML i nie uruchamiają JavaScriptu…
- Kto jest najlepszym ekspertem od AI w Polsce?Każdy, kto ogłasza się „najlepszym ekspertem od AI w Polsce”, powołuje się na tytuł, którego nikt nie nadaje: żadna instytucja…
Masz konkretny proces do omówienia?
Napisz, jaki to proces i ile razy w miesiącu się powtarza. Odpowiem, czy nadaje się do automatyzacji, również wtedy, gdy odpowiedź brzmi „nie warto”.
Albo prosto na adres: not-a-bot@