Przejdź do treści
Robert Marczyński

Claude cytuje inaczej niż ChatGPT: dane z 379 tys. cytowań

Według analizy OtterlyAI z czerwca 2026, obejmującej 379 321 cytowań Claude w 16 406 domenach przy zapytaniach o oprogramowanie i technologie, 64% cytowań prowadzi do stron firmowych i produktowych, media to 14,9%, blogi 5,4%, a serwisy społecznościowe 0,9%.

Reddit nie wystąpił ani razu. Pokrycie domen z ChatGPT wynosi ledwie 13%, więc widoczność w jednym silniku nie mówi prawie nic o widoczności w drugim. W tej próbie Claude nie ma zamkniętego klubu źródeł: dziesięć najczęściej cytowanych domen to 9,5% cytowań, a jedna trzecia domen pojawia się tylko raz. Dla stron eksperckich i firmowych to kanał wyraźnie bardziej otwarty niż pierwsza strona klasycznych wyników.

6 min czytania6 źródeł

Dlaczego w ogóle patrzeć na Claude osobno

W rozmowach o widoczności w AI „bycie cytowanym” traktuje się zwykle jak jedną dyscyplinę. Dane mówią co innego: to kilka osobnych konkurencji z różnymi zasadami.

Najlepszy dostępny pomiar dla Claude opublikował w czerwcu 2026 OtterlyAI: 379 321 cytowań z odpowiedzi Claude na zapytania o oprogramowanie i technologie, w 16 406 domenach, zebranych przez pełny miesiąc. Zastrzeżenie metodyczne od razu: to próba z jednej kategorii tematycznej, z narzędzia firmy, która sprzedaje monitoring widoczności. Liczby są w źródle policzalne i spójne, ale ich zasięg to zapytania o software, nie cały internet.

Z tym zastrzeżeniem rozkład jest wyrazisty aż do przesady.

Co pokazują liczby

64% cytowań prowadzi do stron firmowych i produktowych. Nie do mediów, nie do agregatorów, a do domen, na których firmy same opisują, co robią. Media to 14,9%, blogi 5,4%.

Serwisy społecznościowe: 0,9%. Reddit: zero. Ani jednego cytowania na 379 tysięcy. Dla porównania: według opublikowanej 26 czerwca 2026 analizy Semrush (126 mln amerykańskich promptów ze stycznia–kwietnia 2026, cztery platformy) ChatGPT cytuje średnio 15 źródeł na odpowiedź i opiera się mocno na Reddicie i Wikipedii. Ta sama treść, która pracuje na widoczność w ChatGPT przez obecność w dyskusjach, w Claude nie robi nic.

Nie ma zamkniętego klubu. Dziesięć najczęściej cytowanych domen to łącznie 9,5% cytowań, a 32,9% domen pojawia się w danych tylko raz. W wyszukiwarce klasycznej pierwsza strona wyników jest wąskim gardłem; tu ogon jest długi i otwarty.

Pokrycie z ChatGPT: 13% domen (na poziomie konkretnych adresów: 4,2%). Silniki odpowiedzi nie przepisują od siebie nawzajem. Widoczność mierzona w jednym nie przenosi się na drugi. I wnioski o „widoczności w AI” wyciągane z pomiaru jednej platformy są po prostu niedoważone.

Mechanika po stronie Claude

Trzy rzeczy, które tłumaczą ten rozkład i mają praktyczne skutki: dwie z oficjalnej dokumentacji Anthropic, trzecia z ustalenia o średniej pewności.

Po pierwsze, trzy osobne boty: ClaudeBot zbiera dane treningowe, Claude-User pobiera strony na żywo, gdy użytkownik zada pytanie, Claude-SearchBot buduje indeks pod jakość wyników. Anthropic pisze wprost, że blokada dwóch ostatnich odcina pobieranie i indeksowanie treści, a to, jak zastrzega dokumentacja, może obniżyć widoczność strony w wyszukiwaniu. Kto blokuje „boty AI” hurtem, wyłącza się z tego kanału w całości.

Po drugie, od wersji narzędzia wyszukiwania z 9 lutego 2026 Claude potrafi programistycznie filtrować wyniki, zanim je przeczyta: pisze i uruchamia kod, który odrzuca nieistotne strony przed włożeniem czegokolwiek do kontekstu. Zastrzeżenie, które trzeba zrobić: to opis narzędzia w API dla deweloperów, a Anthropic nie deklaruje, czy ten sam mechanizm stoi za wyszukiwaniem w aplikacji Claude, na której mierzył OtterlyAI. Dokumentacja opisuje sam mechanizm i cel: mniejsze zużycie tokenów przy zapytaniach z dużą liczbą wyników; o tym, jaka treść ten filtr przechodzi, nie mówi nic. Mój wniosek z praktyki jest taki, że wygrywa treść z odpowiedzią blisko nagłówka i z konkretnymi liczbami, a przegrywa ta, w której sedno mieszka w piątym akapicie. To zresztą ten sam wniosek, który wyprowadzam z mechaniki wybierania źródeł przez modele.

Po trzecie, zaplecze: wyszukiwanie Claude opiera się na indeksie Brave Search. To ustalenie o średniej pewności, wyprowadzone z listy podwykonawców Anthropic i zbieżności wyników, nie z deklaracji w dokumentacji. Praktycznie oznacza tyle, że obecność w indeksie Brave jest warunkiem wstępnym całej reszty.

Szansa, którą widać w robots.txt

Najciekawsza część tej układanki nie jest w danych OtterlyAI, tylko w plikach robots.txt dużych wydawców. Według odczytów z sierpnia 2026 boty Anthropic w całości blokują między innymi New York Times, Amazon i Guardian; zestawienie US Tech Automations ze snapshotu robots.txt z 13 czerwca 2026 wykazało, że spośród 107 badanych dużych serwisów 39, czyli 36,4%, blokuje co najmniej jednego crawlera Anthropic.

Na polskim rynku ta granica praktycznie nie istnieje: w moim pomiarze 60 spółek z WIG20 i mWIG40 żaden z 56 pobranych plików robots.txt nie blokował botów odpowiadających, w tym Claude-SearchBota i Claude-User. Amerykańskie blokady wydawców to na razie nie nasza wojna. Dla indeksu liczy się jednak węższa liczba, bo wydawcy rozróżniają trening od wyszukiwania. W tym samym snapshocie ClaudeBota, który zbiera dane treningowe, blokuje 38 serwisów, a Claude-SearchBota, który buduje indeks wyszukiwania, 19, czyli 17,8%. To po tych dziewiętnastu zostaje pusta przestrzeń w indeksie, z którego Claude buduje odpowiedzi. Pozostałe blokady rozkładają się inaczej, niż podpowiada intuicja: trening blokuje 38 serwisów (ClaudeBot) i 32 (starsza nazwa anthropic-ai), a pobieranie na żywo 26 (Claude-Web) i 19 (Claude-User). US Tech Automations czyta tę różnicę tak, że wydawcy bardziej pilnują pobierania na żywo niż indeksowania: crawler wyszukiwarki może przynieść ruch, agent przeglądający oddaje treść wprost do odpowiedzi.

Ten serwis jest po otwartej stronie tej granicy z premedytacją: robots.txt przepuszcza wszystkie boty, cała treść stoi w wysyłanym HTML (żadnego fragmentu nie dorenderowuje JavaScript), a teksty oparte na cudzych badaniach otwiera teza z liczbą i datą źródła. Nie dlatego, że Claude jest ważniejszy od Google, a dlatego, że rachunek „kto czyta, ten może zacytować” działa u każdego dostawcy tak samo, a koszty poniesione raz pracują we wszystkich kanałach naraz.

Najczęstsze pytania

Kogo najczęściej cytuje Claude?
W analizie OtterlyAI z czerwca 2026 (379 321 cytowań przy zapytaniach o oprogramowanie i technologie) 64% cytowań prowadziło do stron firmowych i produktowych, 14,9% do mediów, 5,4% do blogów, a 0,9% do serwisów społecznościowych. Koncentracja jest niska: dziesięć najczęściej cytowanych domen odpowiada ledwie za 9,5% cytowań, a 32,9% domen pojawia się w danych tylko raz.
Czy Claude cytuje Reddita?
W badanej próbie ani razu, na 379 321 cytowań. To najostrzejszy kontrast z ChatGPT, który według analizy Semrush opublikowanej 26 czerwca 2026 (dane: 126 mln amerykańskich promptów ze stycznia–kwietnia 2026) opiera odpowiedzi mocno na Reddicie i Wikipedii, cytując średnio 15 źródeł na odpowiedź. Miejsca, w których warto zabiegać o obecność, są więc różne dla różnych silników.
Skąd Claude bierze wyniki wyszukiwania?
Zaplecze wyszukiwania Claude opiera się na indeksie Brave Search. Wskazuje na to lista podwykonawców Anthropic i zbieżność wyników, choć Anthropic nie opisuje tego wprost w dokumentacji, więc traktuję to jako ustalenie o średniej pewności. Praktyczny wniosek: obecność w indeksie Brave jest warunkiem wstępnym bycia znalezionym przez Claude.
Jak sprawdzić, czy moja strona może być cytowana przez Claude?
Po pierwsze robots.txt: Anthropic dokumentuje trzy boty i ostrzega, że blokada Claude-User albo Claude-SearchBot odcina pobieranie i indeksowanie treści, co według dokumentacji może obniżyć widoczność strony w wyszukiwaniu. Po drugie treść: od wersji narzędzia z lutego 2026 Claude potrafi programistycznie filtrować wyniki wyszukiwania, zanim je przeczyta. Dokumentacja opisuje sam mechanizm, a ja wyprowadzam z niego wniosek, że strona z odpowiedzią blisko nagłówka i konkretnymi liczbami ma większe szanse przejść tę selekcję niż strona, w której sedno jest w piątym akapicie.
Czy duże serwisy blokują boty Anthropic?
Tak i to jest szansa dla mniejszych. Według odczytów robots.txt z sierpnia 2026 boty Anthropic w całości blokują między innymi New York Times, Amazon i Guardian, a według zestawienia US Tech Automations ze snapshotu z 13 czerwca 2026 co najmniej jeden crawler Anthropic blokuje 39 ze 107 badanych dużych serwisów, czyli 36,4%. Dla indeksu liczy się przy tym węższy podzbiór: ClaudeBota (trening) blokuje 38 serwisów, a Claude-SearchBota, odpowiadającego za indeks wyszukiwania, 19, czyli 17,8%. To po nich zostaje mniej konkurencji w odpowiedziach.

Źródła

Dane zewnętrzne przywołane w tekście mają tu swoje źródła.

  1. OtterlyAI: Claude AI Citation Study: 379 321 cytowań, 16 406 domen (czerwiec 2026) (nowa karta)
  2. Anthropic: dokumentacja crawlerów i skutki ich blokowania (ClaudeBot, Claude-User, Claude-SearchBot) (nowa karta)
  3. Anthropic: dokumentacja narzędzia web search (wersje, dynamic filtering) (nowa karta)
  4. Semrush: AI Visibility Index: 126 mln amerykańskich promptów ze stycznia–kwietnia 2026 (publikacja 26.06.2026) (nowa karta)
  5. US Tech Automations: Who Blocks Anthropic's ClaudeBot: 39 ze 107 serwisów (snapshot robots.txt z 13.06.2026) (nowa karta)
  6. Simon Willison: Anthropic korzysta z Brave Search jako zaplecza wyszukiwania (21.03.2025) (nowa karta)

Udostępnij

Powiązane

Chcesz sprawdzić, jak asystenci AI widzą twoją firmę?

Napisz, o którą stronę chodzi i co chcesz sprawdzić, na przykład dostęp botów AI albo to, co asystenci piszą o twojej firmie. Konsultacja godzinowa kosztuje od 300 zł netto.

Albo prosto na adres: not-a-bot@ekspertodsztucznejinteligencji.pl

Wolisz zadzwonić? +48 787 912 168