Content-Signal w robots.txt: co to jest i czy warto go dodać
Krótka odpowiedź
Content-Signal to ogłoszona przez Cloudflare 24 września 2025 konwencja: jedna linia w robots.txt z trzema sygnałami — search, ai-input i ai-train — deklarującymi, do czego wolno użyć treści strony. To deklaracja preferencji, nie techniczna blokada, ale adopcja jest realna: Cloudflare dopisuje sygnał ai-train=no w zarządzanych plikach robots.txt ponad 3,8 mln domen, a w moim pomiarze z sierpnia 2026 własny Content-Signal miały już 4 z 56 spółek GPW — w tym jedna deklarująca pełną zgodę.
Robert Marczyński4 min czytania3 źródła
Content-Signal to jedna linia w pliku robots.txt, która deklaruje, do czego wolno użyć treści strony — na przykład:
Content-Signal: search=yes, ai-input=yes, ai-train=no
Czyli: indeksuj i pokazuj w wyszukiwaniu, podawaj modelom przy budowaniu odpowiedzi, ale nie trenuj na tym modeli. Konwencję ogłosił Cloudflare 24 września 2025 jako Content Signals Policy i to obecnie najprostszy sposób, żeby zapisać decyzję o botach AI bez wymieniania dziesiątek nazw.
Trzy sygnały i co znaczą
search — klasyczne wyszukiwanie: indeksowanie i pokazywanie odnośników w wynikach.
ai-input — podawanie treści modelowi w chwili budowania odpowiedzi na pytanie użytkownika, czyli grounding. To ten sygnał dotyczy bycia cytowanym przez asystentów.
ai-train — użycie treści do trenowania modeli.
Wartość yes to zgoda, no — jej brak. W realnych plikach spotyka się też czwarty element, use, opisujący sposób wykorzystania treści — w moim pomiarze spółek GPW miały go dwie firmy, w bloku reguł dokładanym przez Cloudflare (search=yes, ai-train=no, use=reference).
Deklaracja, nie egzekucja — i dlaczego to mimo wszystko działa
Content-Signal niczego technicznie nie blokuje. To zapis preferencji w miejscu, które boty i tak czytają — jak całe robots.txt, które też jest prośbą, nie zaporą. Siła konwencji leży w trzech rzeczach.
Po pierwsze, jednoznaczność: trzy sygnały pokrywają dokładnie te trzy użycia treści, o które toczy się cały spór, bez dwuznaczności nazw botów. Po drugie, zwięzłość: jedna linia zamiast kilkudziesięciu grup reguł, które łatwo napisać źle — w moim pomiarze jedyna rozbudowana, ręcznie pisana polityka botów wyglądała na obowiązującą, a nie ograniczała niczego. Po trzecie, ślad woli: maszynowo czytelna deklaracja, na którą można się powołać wobec operatora bota.
Skala adopcji nie jest już teoretyczna. Cloudflare dopisuje search=yes, ai-train=no w zarządzanych plikach robots.txt ponad 3,8 mln domen, których właściciele wybrali blokadę treningu. A w polskiej czołówce giełdowej własny sygnał miały w sierpniu 2026 już 4 spółki z 56 — ciekawie zróżnicowane: Tauron z ai-train=no, Text z pełną zgodą ai-train=yes, search=yes, ai-input=yes. Ten drugi przypadek pokazuje wartość konwencji z mniej oczywistej strony: pozwala zadeklarować także zgodę, czego samymi regułami blokującymi nie da się wyrazić.
Czy dodać u siebie
Tak — niezależnie od treści decyzji. W moim pomiarze 49 z 56 spółek nie zostawiło w robots.txt żadnego śladu decyzji o botach AI: ani nazwanego bota, ani sygnału. Brak decyzji też jest decyzją, tylko podjętą przez zaniechanie. Jedna linia zamienia to w wybór zapisany.
Dobór wartości wynika z celu strony. Serwis, który żyje z bycia znajdowanym — a tak działa strona firmowa — deklaruje search=yes, ai-input=yes, bo blokada kanału odpowiedzi wycina go z cytowań; decyzja o ai-train to osobny rachunek zasad i widoczności. Gotowe pliki z sygnałem w trzech wariantach znajdziesz we wzorze robots.txt dla botów AI.
Najczęstsze pytania
- Jak wygląda składnia Content-Signal i co znaczą sygnały?
- To pojedyncza linia w robots.txt, na przykład: Content-Signal: search=yes, ai-input=yes, ai-train=no. Trzy sygnały zdefiniowane w polityce z września 2025 to search (indeksowanie i wyniki wyszukiwania), ai-input (podawanie treści modelowi przy budowaniu odpowiedzi, czyli grounding) i ai-train (trening modeli). Wartość yes wyraża zgodę na dane użycie, no — jej brak. W realnych plikach spotyka się też sygnał use, opisujący sposób wykorzystania treści; w moim pomiarze z sierpnia 2026 miały go dwie spółki z blokiem reguł od Cloudflare.
- Czy Content-Signal technicznie blokuje boty AI?
- Nie. To deklaracja preferencji zapisana w miejscu, które boty i tak czytają — nie egzekwuje niczego technicznie, podobnie jak samo robots.txt jest prośbą, nie zaporą. Siła konwencji leży gdzie indziej: tworzy jednoznaczny, maszynowo czytelny zapis woli właściciela strony, na który można się powołać, oraz pozwala wyrazić decyzję bez wymieniania dziesiątek botów z nazwy. Twardą blokadę daje dopiero zapora, a listę konkretnych botów — klasyczne reguły Disallow.
- Kto już używa Content-Signal?
- Na dużą skalę Cloudflare: firma zadeklarowała we wrześniu 2025, że w zarządzanych przez siebie plikach robots.txt ponad 3,8 mln domen dopisuje sygnał search=yes, ai-train=no. W Polsce adopcja u największych już się zaczęła: w moim pomiarze spółek WIG20 i mWIG40 z sierpnia 2026 linię Content-Signal miały 4 z 56 plików — Tauron z ai-train=no, dwie spółki z blokiem Cloudflare oraz Text z pełną zgodą ai-train=yes, search=yes, ai-input=yes.
- Czy warto dodać Content-Signal do własnej strony?
- Tak, bo kosztuje jedną linię, a zamienia brak decyzji w decyzję zapisaną. W moim pomiarze z sierpnia 2026 aż 49 z 56 spółek nie zostawiło w robots.txt żadnego śladu decyzji o botach AI — ani nazwanego bota, ani sygnału. Content-Signal domyka tę lukę niezależnie od tego, jaka jest treść decyzji: firma otwarta na cytowania deklaruje zgodę, firma chroniąca treść — jej brak, i obie mają na to maszynowy dowód.
Źródła
Dane zewnętrzne przywołane w tekście mają tu swoje źródła.
- Cloudflare — Giving users choice with Cloudflare's new Content Signals Policy (24.09.2025; trzy sygnały, 3,8 mln domen z managed robots.txt) (nowa karta)
- Content Signals Policy — strona konwencji (nowa karta)
- Badanie własne — Content-Signal w plikach robots.txt spółek GPW (pomiar 10–11.08.2026: 4 z 56) (nowa karta)
Udostępnij
Powiązane
- Robots.txt dla botów AI — wzór, który naprawdę działaPoprawny robots.txt dla botów AI opiera się na jednej zasadzie z RFC 9309: ograniczenie powstaje wyłącznie przez regułę Disallow…
- Czy blokować GPTBot? Rachunek dla strony firmowejDla większości firm blokada GPTBota nie ma uzasadnienia: zbiera on wyłącznie dane treningowe, a obecność strony w odpowiedziach…
- Czy AI widzi strony największych spółek z GPW? Zmierzyłem 60 domen10 i 11 sierpnia 2026 zmierzyłem strony korporacyjne wszystkich 60 spółek z WIG20 i mWIG40.
Masz konkretny proces do omówienia?
Napisz, jaki to proces i ile razy w miesiącu się powtarza. Odpowiem, czy nadaje się do automatyzacji, również wtedy, gdy odpowiedź brzmi „nie warto”.
Albo prosto na adres: not-a-bot@