Przejdź do treści
Robert Marczyński

Blog o sztucznej inteligencji w firmach

Analizy oparte na danych i dokumentach źródłowych: statystyki rynku, regulacje, praktyka wdrożeń. Każdy wpis ma listę źródeł.

Nowe analizy możesz czytać w czytniku: kanał RSS. Kilka tekstów w miesiącu, bez newslettera i bez zapisów.

  • Agent AI zapłacił BLIK-iem. Co polski sklep musi mieć, żeby być następny

    Pierwszą pilotażową transakcję BLIK-iem wykonaną samodzielnie przez agenta AI ogłoszono 9 września 2026: agent Juo pilnował dostępności kremu w sklepie Your KAYA, dodał go do koszyka i zapłacił przez PayU 19,99 zł BLIK-iem na podstawie zgody, którą klient dał wcześniej kodem BLIK i potwierdzeniem w aplikacji banku. To jeden test bez oferty handlowej, więc akurat tej ścieżki płatniczej sklep nie ma dziś jak zamówić. Ma za to trzy rzeczy do zrobienia po stronie danych: ofertę czytelną bez JavaScriptu z blokiem Product i Offer, feed produktowy z danymi, jakich wymagają Google i OpenAI, oraz wpis dla botów odpowiadających na pytania. Feed przesądza o widoczności: według pomiaru Profound z września 2026 około 65 procent rekomendacji produktowych w ChatGPT pochodzi ze sklepów zintegrowanych feedem, ale program feedów obejmuje na razie sprzedawców z USA, a same zakupy w ChatGPT działają dla użytkowników w USA.

  • Kogo wybiera agent kodujący. Zmierzyłem 24 decyzje o dostawcach dla polskiej firmyBadanie własne

    W pomiarze z 10 września 2026 dałem agentom kodującym dwanaście zadań pisanych po polsku dla polskiej firmy i kazałem im samodzielnie wybrać dostawcę usługi. Na 24 decyzje (dwanaście zadań w dwóch modelach) polski dostawca wygrał sześć razy, po trzy w każdym modelu, i tylko w dwóch kategoriach wygrał w obu: faktury (Fakturownia) i wysyłka (InPost). Modele zgodziły się co do dostawcy w siedmiu kategoriach na dwanaście; przy SMS-ach dla salonu w Warszawie jeden wskazał Twilio, drugi SMSAPI. PayU pojawił się w rozważaniach dwa razy i nie został wybrany ani razu, podobnie jak jedenaście innych marek z polskiego rynku. Osobno sprawdziłem, czy trzydziestu dostawców jest przygotowanych na klienta, który jest programem: llms.txt w postaci tekstu ma sześciu z piętnastu polskich i trzynastu z piętnastu zagranicznych, a oficjalny serwer MCP dziewięciu, w tym dwóch polskich, i są to Fakturownia oraz inFakt.

  • AI a prace domowe: sprawdziłem badania, na których stoi ta debata

    Publiczna debata o odrabianiu prac domowych przez AI opiera się w dużej mierze na źródłach, które nie wytrzymują sprawdzenia: najgłośniejsze badanie MIT jest po piętnastu miesiącach nadal preprintem na próbie 54 osób, z których do ostatniej sesji dotrwało 18, a metaanalizę o pozytywnym wpływie ChatGPT na uczenie się wycofano w kwietniu 2026 po zebraniu 290 cytowań. Zostaje jeden mocny eksperyment: randomizowane badanie na blisko tysiącu licealistów opublikowane w PNAS, w którym dostęp do modelu podniósł wyniki na ćwiczeniach o 48 procent, a na egzaminie bez AI ci sami uczniowie wypadli o 17 procent gorzej od grupy, która modelu nigdy nie miała.

  • Gdzie studiować AI? Sprawdziłem dane o zarobkach absolwentówBadanie własne

    Na tej samej uczelni absolwenci klasycznej informatyki zarabiają zwykle więcej niż absolwenci kierunku z „sztuczną inteligencją” w nazwie — w moich obliczeniach na danych rejestrowych ELA wygrywa ona w ośmiu z jedenastu możliwych porównań rocznika 2024, z przewagą od 4 do 52 procent. Ogólnopolskie zestawienie wypada odwrotnie, ale to artefakt: kierunki AI prowadzą niemal wyłącznie uczelnie z górnej półki. Największą zmierzoną przewagę daje jednak co innego niż nazwa kierunku: doświadczenie zawodowe sprzed dyplomu wiąże się z zarobkami wyższymi o 45 do 57 procent.

  • Claude Fable 5.1: ceny bazowe bez zmian, na tańszym cache zyskają głównie agenci

    Anthropic wydał 1 września 2026 Claude Fable 5.1 i Mythos 5.1. Ceny bazowe API nie zmieniły się względem Fable 5 (10 USD za milion tokenów wejścia, 50 USD za wyjście), a jedyną zmianą cennikową jest odczyt z cache, tańszy o 75% (0,25 USD zamiast 1,00 USD za milion tokenów). Deklarowane przez producenta oszczędności, ok. 25% przy typowych obciążeniach i do ok. 45% przy agentowych, wynikają z tej obniżki i z mniejszego zużycia tokenów, dotyczą więc głównie długiego kontekstu czytanego wielokrotnie, a nie pojedynczych zapytań. Największe skoki w benchmarkach to Terminal-Bench-Science z 24,7% do 52,6% i AutomationBench z 17,1% do 31,4%, ale to liczby producenta z dnia premiery, bez niezależnych replikacji. Mythos 5.1 to ten sam model z innymi zabezpieczeniami, dostępny na razie wyłącznie dla zweryfikowanych organizacji z USA, więc polska firma pracuje na Fable. Wyjścia modeli wydanych po 2 sierpnia 2026 noszą niewidoczny znak wodny, który Anthropic wiąże z EU AI Act.

  • Agenci zakupowi nie odczytują 39 procent strony sklepu w USA. Dane Adobe i pomiar polskich spółek

    Adobe zmierzył w lipcu 2026, że strony główne amerykańskich sklepów są dla agentów zakupowych czytelne średnio w 61 procentach: prawie dwie piąte treści do nich nie dociera. W raporcie za I kwartał 2026, opublikowanym w kwietniu, było to 75 procent, ale na węższej, nieujawnionej próbie, więc obu odczytów nie porównuje się na tych samych stronach. Ruch z asystentów wzrósł w tym czasie o 62 procent rok do roku, a klient z tego kanału kupuje o 60 procent częściej i zostawia o 53 procent więcej przychodu na wizytę. Mój pomiar 60 spółek z WIG20 i mWIG40 z 10 i 11 sierpnia 2026 pokazuje tę samą nieczytelność po polsku: 26 stron bez danych strukturalnych, 14 tracących bez JavaScriptu ponad jedną piątą treści.

  • Płatności agentowe 2026: agenci AI dostają portfele, kto płaci i jak dowieść zgody

    Płatności agentowe wyszły z pilotaży: Worldline, ING i Mastercard rozliczyły 2 czerwca 2026 w produkcji pierwszą, według komunikatu, europejską transakcję agenta AI, a Visa ogłosiła 2 lipca 2026 zakupy agentów u sprzedawców z udziałem ponad 30 banków wydających karty, w tym PKO BP i mBank. Stos ma pięć warstw: odkrywanie oferty i koszyk (ACP, UCP), dowód zgody (AP2 w FIDO Alliance), sieci kartowe (Visa, Mastercard), płatności maszyna–maszyna (MPP, x402 pod Linux Foundation) i metody lokalne (BLIK z PPRO, partnerstwo ogłoszone 12 sierpnia 2026, w budowie). Luką jest prawo: w Unii płatność agenta podlega PSD2 i silnemu uwierzytelnieniu klienta, a odpowiedzialność za błędny zakup agenta nie ma jeszcze osobnych przepisów ani znanej mi praktyki.

  • MCP bez stanu, WebMCP w przeglądarce: czy asystent AI zarezerwuje hotel?

    Specyfikacja MCP z 28 lipca 2026 usuwa sesje i handshake z protokołu, więc serwer MCP staje się zwykłą, skalowalną usługą HTTP — przy oficjalnych SDK pobieranych łącznie blisko pół miliarda razy miesięcznie. WebMCP, rozwijana przez Google i Microsoft propozycja W3C, robi to samo od strony przeglądarki: strona wystawia agentowi narzędzia, zamiast liczyć, że ten trafi w przyciski — na sierpień 2026 wywołuje je jednak w praktyce wyłącznie agent w przeglądarce z włączonym origin trial (Chrome od wersji 149, Edge od 150), bez udziału zdalnych asystentów. Wyszukanie i porównanie hotelu przez asystenta działa już dziś w ChatGPT dzięki aplikacjom Booking.com i Expedii, ale płatność od początku zostaje u sprzedawcy — a finalizację zakupów w czacie OpenAI wycofał w marcu 2026 nawet w handlu detalicznym.

  • Agenci AI w przeglądarce: co Comet i los Atlasa mówią firmom

    Rynek przeglądarek agentowych rozstrzygnął się w rok: Perplexity udostępnił Comet za darmo wszystkim użytkownikom Windows i macOS 2 października 2025, a OpenAI ogłosił 9 lipca 2026 zamknięcie przeglądarki Atlas — działa do 9 sierpnia 2026, a funkcje agentowe przenoszą się do aplikacji ChatGPT, rozszerzenia Chrome i przeglądarki w chmurze. Wniosek OpenAI, że przeglądarka to funkcja, nie cel, ma praktyczną konsekwencję dla firm: agent staje się nowym typem gościa na stronie — klientem z rękami robota — i infrastruktura już się na to przestawia, z domyślnymi blokadami kategorii Agent w Cloudflare od 15 września 2026 włącznie.

  • Cloudflare od 15 września 2026 domyślnie zablokuje część botów AI

    Ogłoszona 1 lipca 2026 zmiana w Cloudflare dzieli boty AI na trzy kategorie — Search, Agent i Training — a od 15 września 2026 nowe domeny wchodzące do Cloudflare dostaną domyślną blokadę kategorii Training i Agent na stronach wyświetlających reklamy, przy domyślnie przepuszczanej kategorii Search. Istniejących konfiguracji zmiana nie nadpisuje, ale precedens jest ważniejszy niż zasięg: domyślne ustawienia infrastruktury zaczynają decydować o dostępie botów, zanim właściciel strony podejmie jakąkolwiek decyzję.

  • Czy AI widzi strony największych spółek z GPW? Zmierzyłem 60 domenBadanie własne

    10 i 11 sierpnia 2026 zmierzyłem strony korporacyjne wszystkich 60 spółek z WIG20 i mWIG40. Żaden z 56 pobranych plików robots.txt nie blokuje botów odpowiadających na pytania użytkowników; dwie spółki blokują jednak Google-Extended, token sterujący także groundingiem odpowiedzi Gemini. Główna luka leży w tożsamości maszynowej: 26 z 60 stron nie ma ani jednego bloku danych strukturalnych w kodzie dostępnym bez JavaScriptu, a znacznik Organization ma 23 z 60. Bez wykonania skryptów bot dostaje medianowo 98 proc. treści, przy czym 14 stron na 60 traci ponad jedną piątą, a dwie ponad połowę.

  • Boty AI nie wykonują JavaScriptu. Co widzą zamiast strony

    Crawlery asystentów AI — GPTBot, ClaudeBot, PerplexityBot i pokrewne — pobierają surowy HTML i nie uruchamiają JavaScriptu, więc treść dorenderowywana w przeglądarce dla nich nie istnieje. W udokumentowanym na forum r/TechSEO przypadku z lipca 2026 strona cennika aplikacji SaaS w Reakcie miała w surowym HTML 194 słowa i zero kwot wobec 511 słów widocznych w przeglądarce. Sprawdzenie własnej strony zajmuje jedną komendę: pobrać ją curlem i zobaczyć, co zostaje bez przeglądarki.

  • Claude cytuje inaczej niż ChatGPT: dane z 379 tys. cytowań

    Według analizy OtterlyAI z czerwca 2026, obejmującej 379 321 cytowań Claude w 16 406 domenach przy zapytaniach o oprogramowanie i technologie, 64% cytowań prowadzi do stron firmowych i produktowych, media to 14,9%, blogi 5,4%, a serwisy społecznościowe 0,9% — Reddit nie wystąpił ani razu. Pokrycie domen z ChatGPT wynosi ledwie 13%, więc widoczność w jednym silniku nie mówi prawie nic o widoczności w drugim. W tej próbie Claude nie ma zamkniętego klubu źródeł: dziesięć najczęściej cytowanych domen to 9,5% cytowań, a jedna trzecia domen pojawia się tylko raz — dla stron eksperckich i firmowych kanał wyraźnie bardziej otwarty niż pierwsza strona klasycznych wyników.

  • Cytowanie w AI Overviews prawie nie daje kliknięć. Dane Pew

    Według Pew Research Center kliknięcia w źródła cytowane w Google AI Overviews wystąpiły w około 1% odwiedzin stron wyników z przeglądem, a obecność przeglądu wiąże się z rzadszym klikaniem w jakiekolwiek wyniki i częstszym kończeniem sesji. Dane pochodzą z panelu 900 dorosłych Amerykanów i obejmują marzec 2025 — krążące po sieci wersje „nowego badania z 2026 roku” to w rzeczywistości sformalizowana na arXiv w sierpniu 2026 wersja tej samej analizy. Wniosek nie brzmi „cytowania nie mają wartości”, tylko „wartością cytowania jest obecność w odpowiedzi, nie ruch”.

  • Tryb AI i Przegląd od AI w Polsce: co realnie pokrywają

    Obie warstwy AI w polskiej wyszukiwarce Google już działają: Przegląd od AI (AI Overviews) od 26 marca 2025, po polsku i angielsku, a Tryb AI (AI Mode) od 8 października 2025, jako pełne udostępnienie, nie eksperyment. Według danych Senuto z listopada 2025 Przegląd od AI pojawiał się przy 28,95% polskich fraz, ale pokrywał tylko 14,87% wolumenu wyszukiwań, bo dominuje na długim ogonie zapytań informacyjnych. Tryb AI nie zastąpił przy tym klasycznych wyników: na I/O Google napisał wprost, że wyniki z wyszukiwarki zostają, a w czerwcu 2026 zdementował plany ustawienia Trybu AI jako domyślnego dla wyszukiwań z paska Chrome.

  • Własny model czy API: rachunek na rok

    Porównanie własnego modelu z modelem udostępnianym przez API to porównanie kosztu stałego ze zmiennym, a nie dwóch cen za to samo. API rozlicza się za przetworzony tekst, więc rachunek rośnie proporcjonalnie do użycia i przy zerowym ruchu wynosi zero. Serwer z własnym modelem rozlicza się za czas, więc kosztuje tyle samo w nocy i w weekend. O progu opłacalności decyduje relacja stałego kosztu maszyny do stawki za milion jednostek dla klasy modelu, którą chcecie zastąpić, a ponieważ maszyna kosztuje tyle samo bez obciążenia, o wyniku przesądza przede wszystkim równomierność ruchu. Do tego dochodzą pozycje, których w porównaniach cen zwykle nie ma: nadmiarowość, czas człowieka na utrzymanie i testy po każdej zmianie wersji.

  • Shadow AI w polskich firmach: dane

    Według badania ARC Rynek i Opinia dla ESET i DAGMA (CAWI, marzec 2026, 1026 osób pracujących przy komputerze) 62% pracowników korzysta w pracy z narzędzi AI, ale tylko 27% badanych mówi, że ich firma ma spisane zasady takiego korzystania. Zestawienia tych liczb z danymi GUS nie da się rozliczyć co do punktu procentowego, bo GUS liczy firmy od dziesięciu pracujących, a badanie ESET ludzi pracujących przy komputerze. Po odjęciu różnic w konstrukcji obu badań najprostszym wyjaśnieniem reszty pozostaje korzystanie z AI poza wiedzą firmy, a z deklaracji respondentów wynika, że sam zakaz tego nie odwraca: przenosi korzystanie poza pole widzenia pracodawcy.

  • ROI wdrożeń AI: rok rozliczenia projektów

    Według badania EY na 499 polskich firmach (Q4 2025) tylko 44% firm usługowych systematycznie mierzy efekty wdrożeń AI, 18% wstrzymało lub porzuciło projekty, a jedynie 38% ocenia, że korzyści spełniły oczekiwania. Rok 2026 jest rokiem rozliczenia: przewagę ma ten, kto od pierwszego dnia mierzył jedną konkretną liczbę, a sama liczba wdrożeń schodzi na dalszy plan.

  • Google AI Mode a CTR: pierwsze dane z Polski

    W pierwszym polskim badaniu wpływu Google AI Mode (Semgence, dane Search Console Q1 2025 vs Q1 2026; z 40 zgłoszonych domen analiza porównawcza objęła 34) CTR spadł na 88% analizowanych domen, średnio z 2,28% do 1,41%. Łączna liczba kliknięć spadła jednak tylko o 3,6%, a po odsianiu artefaktów technicznych czysty efekt AI Mode autorzy szacują na około 0,18 punktu procentowego. Ucierpiały przede wszystkim strony informacyjne B2B, około 2,5 razy mocniej niż e-commerce.

  • Ustawa o sztucznej inteligencji 2026: obowiązki firm

    Podpisana 24 lipca 2026 ustawa o systemach sztucznej inteligencji uruchamia w Polsce realny nadzór nad AI: od listopada Komisja Rozwoju i Bezpieczeństwa Sztucznej Inteligencji będzie mogła kontrolować firmy i nakładać kary sięgające 35 mln euro lub 7% światowego obrotu. Dla małych i średnich firm jest też marchewka: bezpłatna piaskownica regulacyjna do testowania systemów AI pod okiem nadzoru.

  • Loop development: programowanie w pętli z AI

    Loop development przenosi punkt ciężkości z pisania promptów na projektowanie pętli: zamiast prowadzić agenta krok po kroku, definiujesz sprawdzalny cel i pozwalasz mu iterować, aż go osiągnie. Metoda działa dokładnie tak dobrze, jak dobry jest warunek stopu i test, który go sprawdza, i zawodzi wszędzie tam, gdzie sukcesu nie da się zweryfikować automatycznie.

  • Czy llms.txt działa? Co mówią dane

    Nie w tym sensie, w jakim obiecywano. Plik llms.txt, czyli propozycję standardu z 2024 roku na mapę treści serwisu dla modeli językowych, według analizy Ahrefs z maja 2026 na 137 210 domen w 97 procentach przypadków nie pobrano ani razu, a Google w nocie z 15 czerwca 2026 stwierdził, że plik nie jest potrzebny dla wyszukiwarki i nie wpływa na widoczność ani pozytywnie, ani negatywnie. Adopcja rośnie mimo to: w sierpniu 2026 plik doczekał się drugiej wersji specyfikacji. W moim pomiarze 60 spółek z WIG20 i mWIG40 z 10 i 11 sierpnia 2026 plik miało 12 z 58 zmierzonych stron. Wniosek: wdrażać, jeśli generuje się automatycznie i pozostaje mały, ale bez oczekiwań wobec widoczności.

  • Jak modele AI wybierają źródła, które cytują

    Modele AI w trybie wyszukiwania podchwytują treść ze strony wtedy, gdy jest ona jedyną bezpośrednią odpowiedzią na wąskie pytanie, a przy pytaniach szerokich są odporne na sztucznie budowany autorytet. W badaniu Authoritas z grudnia 2025 na dziewięciu modelach żaden z jedenastu fikcyjnych ekspertów, umieszczonych w ponad 600 artykułach prasowych, nie pojawił się w odpowiedzi na pytanie o wiodących specjalistów w dziedzinie.

  • AI Act: nowe terminy po Digital Omnibus

    Nowelizacja Digital Omnibus, przyjęta przez Parlament Europejski 16 czerwca i przez Radę 29 czerwca 2026, przesuwa obowiązki dla samodzielnych systemów AI wysokiego ryzyka z 2 sierpnia 2026 na 2 grudnia 2027, a dla systemów wbudowanych w produkty objęte prawem produktowym na 2 sierpnia 2028. Nie przesuwa natomiast obowiązków przejrzystości z art. 50, które stosują się od 2 sierpnia 2026, poza jednym wyjątkiem: maszynowe oznaczanie treści w systemach wprowadzonych do obrotu przed tą datą ma czas do 2 grudnia 2026, ani zakazanych praktyk obowiązujących od 2 lutego 2025. Obowiązek kompetencji AI z art. 4 obowiązuje od 2 lutego 2025, ale nowelizacja złagodziła go do obowiązku starannego działania.

  • Ile polskich firm używa AI? Dane GUS

    Według GUS w 2025 roku technologie sztucznej inteligencji wykorzystywało 8,7% przedsiębiorstw w Polsce, przy średniej unijnej około 20%, a rozkład tych danych według wielkości firmy pokazuje, że główną barierą nie jest branża ani technologia, tylko zasoby organizacyjne potrzebne do przeprowadzenia wdrożenia.

Udostępnij

Masz konkretny proces do omówienia?

Napisz, jaki to proces i ile razy w miesiącu się powtarza. Odpowiem, czy nadaje się do automatyzacji, również wtedy, gdy odpowiedź brzmi „nie warto”.

Albo prosto na adres: not-a-bot@ekspertodsztucznejinteligencji.pl