# Content-Signal w robots.txt: co to jest i czy warto go dodać

> Content-Signal to ogłoszona przez Cloudflare 24 września 2025 konwencja: jedna linia w robots.txt z trzema sygnałami — search, ai-input i ai-train — deklarującymi, do czego wolno użyć treści strony. To deklaracja preferencji, nie techniczna blokada, ale adopcja jest realna: Cloudflare dopisuje sygnał ai-train=no w zarządzanych plikach robots.txt ponad 3,8 mln domen, a w moim pomiarze z sierpnia 2026 własny Content-Signal miały już 4 z 56 spółek GPW — w tym jedna deklarująca pełną zgodę.

Autor: Robert Marczyński · Opublikowano: 2026-08-12 · Aktualizacja: 2026-08-12
Kanoniczny URL: https://ekspertodsztucznejinteligencji.pl/odpowiedzi/content-signal-w-robots-txt

Content-Signal to jedna linia w pliku robots.txt, która deklaruje, do czego wolno użyć treści strony — na przykład:

```
Content-Signal: search=yes, ai-input=yes, ai-train=no
```

Czyli: indeksuj i pokazuj w wyszukiwaniu, podawaj modelom przy budowaniu odpowiedzi, ale nie trenuj na tym modeli. Konwencję ogłosił Cloudflare 24 września 2025 jako Content Signals Policy i to obecnie najprostszy sposób, żeby zapisać decyzję o botach AI bez wymieniania dziesiątek nazw.

## Trzy sygnały i co znaczą

**`search`** — klasyczne wyszukiwanie: indeksowanie i pokazywanie odnośników w wynikach.

**`ai-input`** — podawanie treści modelowi w chwili budowania odpowiedzi na pytanie użytkownika, czyli [grounding](/odpowiedzi/grounding-ai-co-to-jest). To ten sygnał dotyczy bycia cytowanym przez asystentów.

**`ai-train`** — użycie treści do trenowania modeli.

Wartość `yes` to zgoda, `no` — jej brak. W realnych plikach spotyka się też czwarty element, `use`, opisujący sposób wykorzystania treści — w [moim pomiarze spółek GPW](/blog/widocznosc-ai-wig20-mwig40-pomiar) miały go dwie firmy, w bloku reguł dokładanym przez Cloudflare (`search=yes, ai-train=no, use=reference`).

## Deklaracja, nie egzekucja — i dlaczego to mimo wszystko działa

Content-Signal niczego technicznie nie blokuje. To zapis preferencji w miejscu, które boty i tak czytają — jak całe robots.txt, które też jest prośbą, nie zaporą. Siła konwencji leży w trzech rzeczach.

Po pierwsze, **jednoznaczność**: trzy sygnały pokrywają dokładnie te trzy użycia treści, o które toczy się cały spór, bez dwuznaczności nazw botów. Po drugie, **zwięzłość**: jedna linia zamiast kilkudziesięciu grup reguł, które łatwo napisać źle — w moim pomiarze jedyna rozbudowana, ręcznie pisana polityka botów [wyglądała na obowiązującą, a nie ograniczała niczego](/blog/widocznosc-ai-wig20-mwig40-pomiar). Po trzecie, **ślad woli**: maszynowo czytelna deklaracja, na którą można się powołać wobec operatora bota.

Skala adopcji nie jest już teoretyczna. Cloudflare dopisuje `search=yes, ai-train=no` w zarządzanych plikach robots.txt ponad **3,8 mln domen**, których właściciele wybrali blokadę treningu. A w polskiej czołówce giełdowej własny sygnał miały w sierpniu 2026 już 4 spółki z 56 — ciekawie zróżnicowane: Tauron z `ai-train=no`, Text z pełną zgodą `ai-train=yes, search=yes, ai-input=yes`. Ten drugi przypadek pokazuje wartość konwencji z mniej oczywistej strony: pozwala zadeklarować także **zgodę**, czego samymi regułami blokującymi nie da się wyrazić.

## Czy dodać u siebie

Tak — niezależnie od treści decyzji. W moim pomiarze 49 z 56 spółek nie zostawiło w robots.txt żadnego śladu decyzji o botach AI: ani nazwanego bota, ani sygnału. Brak decyzji też jest decyzją, tylko podjętą przez zaniechanie. Jedna linia zamienia to w wybór zapisany.

Dobór wartości wynika z celu strony. Serwis, który żyje z bycia znajdowanym — a tak działa strona firmowa — deklaruje `search=yes, ai-input=yes`, bo [blokada kanału odpowiedzi wycina go z cytowań](/odpowiedzi/czy-blokowac-gptbot); decyzja o `ai-train` to osobny rachunek zasad i widoczności. Gotowe pliki z sygnałem w trzech wariantach znajdziesz we [wzorze robots.txt dla botów AI](/odpowiedzi/robots-txt-dla-botow-ai-wzor).

## Najczęstsze pytania

**Jak wygląda składnia Content-Signal i co znaczą sygnały?**

To pojedyncza linia w robots.txt, na przykład: Content-Signal: search=yes, ai-input=yes, ai-train=no. Trzy sygnały zdefiniowane w polityce z września 2025 to search (indeksowanie i wyniki wyszukiwania), ai-input (podawanie treści modelowi przy budowaniu odpowiedzi, czyli grounding) i ai-train (trening modeli). Wartość yes wyraża zgodę na dane użycie, no — jej brak. W realnych plikach spotyka się też sygnał use, opisujący sposób wykorzystania treści; w moim pomiarze z sierpnia 2026 miały go dwie spółki z blokiem reguł od Cloudflare.

**Czy Content-Signal technicznie blokuje boty AI?**

Nie. To deklaracja preferencji zapisana w miejscu, które boty i tak czytają — nie egzekwuje niczego technicznie, podobnie jak samo robots.txt jest prośbą, nie zaporą. Siła konwencji leży gdzie indziej: tworzy jednoznaczny, maszynowo czytelny zapis woli właściciela strony, na który można się powołać, oraz pozwala wyrazić decyzję bez wymieniania dziesiątek botów z nazwy. Twardą blokadę daje dopiero zapora, a listę konkretnych botów — klasyczne reguły Disallow.

**Kto już używa Content-Signal?**

Na dużą skalę Cloudflare: firma zadeklarowała we wrześniu 2025, że w zarządzanych przez siebie plikach robots.txt ponad 3,8 mln domen dopisuje sygnał search=yes, ai-train=no. W Polsce adopcja u największych już się zaczęła: w moim pomiarze spółek WIG20 i mWIG40 z sierpnia 2026 linię Content-Signal miały 4 z 56 plików — Tauron z ai-train=no, dwie spółki z blokiem Cloudflare oraz Text z pełną zgodą ai-train=yes, search=yes, ai-input=yes.

**Czy warto dodać Content-Signal do własnej strony?**

Tak, bo kosztuje jedną linię, a zamienia brak decyzji w decyzję zapisaną. W moim pomiarze z sierpnia 2026 aż 49 z 56 spółek nie zostawiło w robots.txt żadnego śladu decyzji o botach AI — ani nazwanego bota, ani sygnału. Content-Signal domyka tę lukę niezależnie od tego, jaka jest treść decyzji: firma otwarta na cytowania deklaruje zgodę, firma chroniąca treść — jej brak, i obie mają na to maszynowy dowód.


## Źródła

- Cloudflare — Giving users choice with Cloudflare's new Content Signals Policy (24.09.2025; trzy sygnały, 3,8 mln domen z managed robots.txt): https://blog.cloudflare.com/content-signals-policy/
- Content Signals Policy — strona konwencji: https://contentsignals.org/
- Badanie własne — Content-Signal w plikach robots.txt spółek GPW (pomiar 10–11.08.2026: 4 z 56): https://ekspertodsztucznejinteligencji.pl/badania/widocznosc-wig-2026-08
