# Dlaczego mojej firmy nie ma w ChatGPT?

> Gdy asystent AI nie wymienia firmy w odpowiedziach, przyczyna leży zwykle po stronie jej strony internetowej, a nie po stronie modelu. W moim pomiarze 60 spółek z WIG20 i mWIG40 z sierpnia 2026 najczęstszym brakiem nie były blokady, których w plikach robots.txt nie znalazłem ani jednej dla botów odpowiadających, lecz brak tożsamości maszynowej: 26 z 60 stron nie miało żadnych danych strukturalnych. Kolejność diagnozy: dane strukturalne, treść w kodzie, zapora, dopiero na końcu robots.txt.

Autor: Robert Marczyński · Opublikowano: 2026-08-12 · Aktualizacja: 2026-08-12
Kanoniczny URL: https://ekspertodsztucznejinteligencji.pl/odpowiedzi/dlaczego-firmy-nie-ma-w-chatgpt

Krótka odpowiedź: najprawdopodobniej dlatego, że Twoja strona nie mówi maszynie, kim jest Twoja firma. To brzmi banalnie, ale w [moim pomiarze 60 spółek z WIG20 i mWIG40](/blog/widocznosc-ai-wig20-mwig40-pomiar) z sierpnia 2026 to był najczęstszy brak — częstszy niż wszystkie pozostałe razem wzięte. Poniżej cztery przyczyny w kolejności od najbardziej prawdopodobnej, każda z testem, który wykonasz sam.

## Przyczyna 1: strona nie ma tożsamości maszynowej

Gdy model buduje odpowiedź o firmie, szuka na stronie formalnego oświadczenia „to jest firma, nazywa się tak, tym się zajmuje” — bloku danych strukturalnych z typem `Organization`. Bez niego musi zgadywać z tekstu, a wtedy firma zlewa się ze spółką o podobnej nazwie albo wypada z zestawienia dostawców, bo model nie rozpoznał branży.

Skala problemu: wśród 60 największych spółek giełdowych 26 nie miało **żadnych** danych strukturalnych, a znacznik `Organization` miały tylko 23. Skoro tak wygląda czołówka rynku, w mniejszych firmach nie jest lepiej.

**Test:** otwórz źródło swojej strony głównej (Ctrl+U) i wyszukaj frazę `application/ld+json`. Jeśli jej nie ma albo w bloku nie występuje `Organization` — to jest pierwsza rzecz do naprawy. [Jak dodać znacznik, opisałem osobno](/odpowiedzi/dane-strukturalne-organization-jak-dodac).

## Przyczyna 2: treść istnieje tylko po wykonaniu skryptów

[Boty wyszukiwarek AI nie wykonują JavaScriptu](/blog/boty-ai-nie-wykonuja-javascriptu) — czytają dokument, który wysyła serwer. Jeżeli ofertę, cennik czy opis usług dokłada skrypt w przeglądarce, dla bota ta treść nie istnieje. W pomiarze spółek problem dotyczył mniejszości, ale wyraźnej: 14 stron na 60 traciło ponad jedną piątą treści, a dwie ponad połowę.

**Test:** wyłącz JavaScript w przeglądarce i odśwież stronę. Jeśli kluczowa treść zniknęła, zajrzyj w źródło strony — zniknięcie z ekranu ma dwa możliwe powody i rozstrzyga kod, nie widok. Treść, której nie ma również w źródle, wstawiał skrypt i bot jej nie dostaje.

## Przyczyna 3: zapora odcina boty, zanim dotrą do treści

Tego nie widać w żadnym pliku konfiguracyjnym strony. W pomiarze dwie spółki odpowiadały botom kodem 403 wyłącznie z powodu nagłówka, a jedna odcinała każdego automatycznego klienta — wszystkie trzy przy robots.txt, który nie blokował żadnego bota odpowiadającego; u jednej z nich plik nie zawierał o botach AI ani jednej linijki. Jeżeli Twój dostawca hostingu albo CDN ma włączoną ochronę przed botami, może ona ciąć również boty odpowiadające na pytania użytkowników.

**Test:** zapytaj dostawcę wprost, czy zapora przepuszcza OAI-SearchBot, ChatGPT-User, Claude-SearchBot, Claude-User, PerplexityBot i Perplexity-User. To pytanie na jedno zgłoszenie do wsparcia technicznego.

## Przyczyna 4: robots.txt — sprawdź, ale nie zaczynaj od niego

Blokada w robots.txt to najczęściej podejrzewana i najrzadziej występująca przyczyna: na 56 sprawdzonych plików spółek giełdowych **ani jeden** nie blokował botów odpowiadających. Sprawdzić warto, bo koszt to jedna minuta, ale jeśli ktoś oferuje Ci „odblokowanie strony dla AI” jako usługę, poproś najpierw o dowód, że akurat u Ciebie taka blokada istnieje.

**Test:** otwórz `twojadomena.pl/robots.txt` i poszukaj nazw botów z listy wyżej przy regule `Disallow: /`. [Poprawny wzór pliku znajdziesz tutaj](/odpowiedzi/robots-txt-dla-botow-ai-wzor).

## Co dalej, gdy wszystkie testy przechodzą

Wtedy strona spełnia warunki wstępne i pytanie przenosi się z „czy model może mnie przeczytać” na „czy ma powód mnie zacytować”. O tym decyduje treść: odpowiedzi na realne pytania klientów, własne liczby zamiast przepisanych cudzych i spójna tożsamość we wszystkich kanałach. [Jak modele wybierają źródła, opisałem osobno](/blog/jak-modele-ai-wybieraja-zrodla) — ale kolejność jest właśnie taka: najpierw warunki wstępne, potem treść. Odwrotna kolejność to inwestowanie w tekst, którego nikt nie przeczyta.

## Najczęstsze pytania

**Czy ChatGPT w ogóle może znaleźć moją firmę?**

Tak, dwiema drogami. Wiedza z treningu obejmuje treści zebrane do daty odcięcia modelu, więc młodsza firma może w niej nie istnieć. Ważniejsza jest druga droga: wyszukiwanie na żywo, w którym bot OAI-SearchBot pobiera strony i model buduje odpowiedź z aktualnych źródeł. Tę drogę firma kontroluje w całości, bo zależy ona od stanu jej strony w dniu pytania, a nie od tego, co model zapamiętał.

**Co najczęściej blokuje widoczność firmy w odpowiedziach AI?**

W moim pomiarze 60 spółek giełdowych z sierpnia 2026 najczęstszy był brak danych strukturalnych: 26 z 60 stron nie miało ani jednego bloku JSON-LD, a znacznik Organization, który mówi maszynie, czym jest firma, miało tylko 23 z 60. Blokad botów odpowiadających nie znalazłem ani jednej na 56 sprawdzonych plików robots.txt. Model, który nie wie, kim jest właściciel strony, nie zacytuje go pewnie.

**Jak sprawdzić, czy moja strona jest czytelna dla botów AI?**

Trzy testy, każdy w kilka minut. Po pierwsze: otwórz źródło strony (Ctrl+U) i poszukaj bloku application/ld+json z typem Organization. Po drugie: wyłącz JavaScript w przeglądarce i odśwież stronę; jeśli oferta zniknęła, sprawdź w źródle, czy treść w ogóle stoi w kodzie, bo boty AI skryptów nie wykonują. Po trzecie: zapytaj dostawcę hostingu, czy zapora nie odcina ruchu automatycznego, bo tego robots.txt nie pokaże.

**Czy wystarczy poprawić stronę, żeby ChatGPT zaczął cytować firmę?**

Strona czytelna dla maszyn to warunek wstępny, nie gwarancja. Po jego spełnieniu o cytowaniu decyduje to, co decyduje zawsze: czy treść odpowiada na pytania, które ludzie zadają, czy niesie własne dane zamiast przepisanych cudzych i czy źródło jest wiarygodne. Bez warunku wstępnego reszta nie ma jednak znaczenia, bo model nie ma czego przeczytać.


## Źródła

- Badanie własne — widoczność stron WIG20 i mWIG40 dla asystentów AI (pomiar 10–11.08.2026, 60 spółek): https://ekspertodsztucznejinteligencji.pl/badania/widocznosc-wig-2026-08
- OpenAI — dokumentacja crawlerów (OAI-SearchBot odpowiada za wyszukiwanie na żywo): https://developers.openai.com/api/docs/bots
