Przejdź do treści
Robert Marczyński

Dlaczego mojej firmy nie ma w ChatGPT?

Krótka odpowiedź

Gdy asystent AI nie wymienia firmy w odpowiedziach, przyczyna leży zwykle po stronie jej strony internetowej, a nie po stronie modelu. W moim pomiarze 60 spółek z WIG20 i mWIG40 z sierpnia 2026 najczęstszym brakiem nie były blokady, których w plikach robots.txt nie znalazłem ani jednej dla botów odpowiadających, lecz brak tożsamości maszynowej: 26 z 60 stron nie miało żadnych danych strukturalnych. Kolejność diagnozy: dane strukturalne, treść w kodzie, zapora, dopiero na końcu robots.txt.

Robert Marczyński4 min czytania2 źródła

Krótka odpowiedź: najprawdopodobniej dlatego, że Twoja strona nie mówi maszynie, kim jest Twoja firma. To brzmi banalnie, ale w moim pomiarze 60 spółek z WIG20 i mWIG40 z sierpnia 2026 to był najczęstszy brak — częstszy niż wszystkie pozostałe razem wzięte. Poniżej cztery przyczyny w kolejności od najbardziej prawdopodobnej, każda z testem, który wykonasz sam.

Przyczyna 1: strona nie ma tożsamości maszynowej

Gdy model buduje odpowiedź o firmie, szuka na stronie formalnego oświadczenia „to jest firma, nazywa się tak, tym się zajmuje” — bloku danych strukturalnych z typem Organization. Bez niego musi zgadywać z tekstu, a wtedy firma zlewa się ze spółką o podobnej nazwie albo wypada z zestawienia dostawców, bo model nie rozpoznał branży.

Skala problemu: wśród 60 największych spółek giełdowych 26 nie miało żadnych danych strukturalnych, a znacznik Organization miały tylko 23. Skoro tak wygląda czołówka rynku, w mniejszych firmach nie jest lepiej.

Test: otwórz źródło swojej strony głównej (Ctrl+U) i wyszukaj frazę application/ld+json. Jeśli jej nie ma albo w bloku nie występuje Organization — to jest pierwsza rzecz do naprawy. Jak dodać znacznik, opisałem osobno.

Przyczyna 2: treść istnieje tylko po wykonaniu skryptów

Boty wyszukiwarek AI nie wykonują JavaScriptu — czytają dokument, który wysyła serwer. Jeżeli ofertę, cennik czy opis usług dokłada skrypt w przeglądarce, dla bota ta treść nie istnieje. W pomiarze spółek problem dotyczył mniejszości, ale wyraźnej: 14 stron na 60 traciło ponad jedną piątą treści, a dwie ponad połowę.

Test: wyłącz JavaScript w przeglądarce i odśwież stronę. Jeśli kluczowa treść zniknęła, zajrzyj w źródło strony — zniknięcie z ekranu ma dwa możliwe powody i rozstrzyga kod, nie widok. Treść, której nie ma również w źródle, wstawiał skrypt i bot jej nie dostaje.

Przyczyna 3: zapora odcina boty, zanim dotrą do treści

Tego nie widać w żadnym pliku konfiguracyjnym strony. W pomiarze dwie spółki odpowiadały botom kodem 403 wyłącznie z powodu nagłówka, a jedna odcinała każdego automatycznego klienta — wszystkie trzy przy robots.txt, który nie blokował żadnego bota odpowiadającego; u jednej z nich plik nie zawierał o botach AI ani jednej linijki. Jeżeli Twój dostawca hostingu albo CDN ma włączoną ochronę przed botami, może ona ciąć również boty odpowiadające na pytania użytkowników.

Test: zapytaj dostawcę wprost, czy zapora przepuszcza OAI-SearchBot, ChatGPT-User, Claude-SearchBot, Claude-User, PerplexityBot i Perplexity-User. To pytanie na jedno zgłoszenie do wsparcia technicznego.

Przyczyna 4: robots.txt — sprawdź, ale nie zaczynaj od niego

Blokada w robots.txt to najczęściej podejrzewana i najrzadziej występująca przyczyna: na 56 sprawdzonych plików spółek giełdowych ani jeden nie blokował botów odpowiadających. Sprawdzić warto, bo koszt to jedna minuta, ale jeśli ktoś oferuje Ci „odblokowanie strony dla AI” jako usługę, poproś najpierw o dowód, że akurat u Ciebie taka blokada istnieje.

Test: otwórz twojadomena.pl/robots.txt i poszukaj nazw botów z listy wyżej przy regule Disallow: /. Poprawny wzór pliku znajdziesz tutaj.

Co dalej, gdy wszystkie testy przechodzą

Wtedy strona spełnia warunki wstępne i pytanie przenosi się z „czy model może mnie przeczytać” na „czy ma powód mnie zacytować”. O tym decyduje treść: odpowiedzi na realne pytania klientów, własne liczby zamiast przepisanych cudzych i spójna tożsamość we wszystkich kanałach. Jak modele wybierają źródła, opisałem osobno — ale kolejność jest właśnie taka: najpierw warunki wstępne, potem treść. Odwrotna kolejność to inwestowanie w tekst, którego nikt nie przeczyta.

Najczęstsze pytania

Czy ChatGPT w ogóle może znaleźć moją firmę?
Tak, dwiema drogami. Wiedza z treningu obejmuje treści zebrane do daty odcięcia modelu, więc młodsza firma może w niej nie istnieć. Ważniejsza jest druga droga: wyszukiwanie na żywo, w którym bot OAI-SearchBot pobiera strony i model buduje odpowiedź z aktualnych źródeł. Tę drogę firma kontroluje w całości, bo zależy ona od stanu jej strony w dniu pytania, a nie od tego, co model zapamiętał.
Co najczęściej blokuje widoczność firmy w odpowiedziach AI?
W moim pomiarze 60 spółek giełdowych z sierpnia 2026 najczęstszy był brak danych strukturalnych: 26 z 60 stron nie miało ani jednego bloku JSON-LD, a znacznik Organization, który mówi maszynie, czym jest firma, miało tylko 23 z 60. Blokad botów odpowiadających nie znalazłem ani jednej na 56 sprawdzonych plików robots.txt. Model, który nie wie, kim jest właściciel strony, nie zacytuje go pewnie.
Jak sprawdzić, czy moja strona jest czytelna dla botów AI?
Trzy testy, każdy w kilka minut. Po pierwsze: otwórz źródło strony (Ctrl+U) i poszukaj bloku application/ld+json z typem Organization. Po drugie: wyłącz JavaScript w przeglądarce i odśwież stronę; jeśli oferta zniknęła, sprawdź w źródle, czy treść w ogóle stoi w kodzie, bo boty AI skryptów nie wykonują. Po trzecie: zapytaj dostawcę hostingu, czy zapora nie odcina ruchu automatycznego, bo tego robots.txt nie pokaże.
Czy wystarczy poprawić stronę, żeby ChatGPT zaczął cytować firmę?
Strona czytelna dla maszyn to warunek wstępny, nie gwarancja. Po jego spełnieniu o cytowaniu decyduje to, co decyduje zawsze: czy treść odpowiada na pytania, które ludzie zadają, czy niesie własne dane zamiast przepisanych cudzych i czy źródło jest wiarygodne. Bez warunku wstępnego reszta nie ma jednak znaczenia, bo model nie ma czego przeczytać.

Źródła

Dane zewnętrzne przywołane w tekście mają tu swoje źródła.

  1. Badanie własne — widoczność stron WIG20 i mWIG40 dla asystentów AI (pomiar 10⁠–⁠11.08.2026, 60 spółek) (nowa karta)
  2. OpenAI — dokumentacja crawlerów (OAI-SearchBot odpowiada za wyszukiwanie na żywo) (nowa karta)

Udostępnij

Powiązane

Masz konkretny proces do omówienia?

Napisz, jaki to proces i ile razy w miesiącu się powtarza. Odpowiem, czy nadaje się do automatyzacji, również wtedy, gdy odpowiedź brzmi „nie warto”.

Albo prosto na adres: not-a-bot@ekspertodsztucznejinteligencji.pl