Przejdź do treści
Robert Marczyński

Ile kosztuje utrzymanie AI miesięcznie?

Krótka odpowiedź

Miesięczny koszt utrzymania rozwiązania AI dzieli się na pozycję rosnącą z użyciem, czyli opłaty za API modelu, i pozycje względnie stałe: hosting, monitoring oraz aktualizację bazy wiedzy. Prosty chatbot przy typowym ruchu na stronie firmowej zamyka się według polskich cenników z 2026 roku w 200⁠–⁠1000 zł miesięcznie.

Robert Marczyński6 min czytania6 źródeł

Z czego składa się rachunek miesięczny

Utrzymanie to pozycja, o której budżety wdrożeń zapominają najczęściej, bo w klasycznych projektach IT nie miała odpowiednika. Rozkłada się na cztery części:

  • API modelu językowego. Opłata od przetworzonych tokenów, naliczana przy każdym użyciu. Jedyna pozycja, która rośnie proporcjonalnie do ruchu.
  • Hosting i infrastruktura. Rynkowo 50⁠–⁠500 zł miesięcznie za serwer przy rozwiązaniu szytym na miarę; w narzędziach abonamentowych wliczone w cenę.
  • Monitoring. Ktoś musi patrzeć, czy odpowiedzi nie zjeżdżają z jakości. Polskie źródła podają 2⁠–⁠4 godziny pracy tygodniowo, co pokrywa się z tym, co widzę w projektach.
  • Aktualizacja bazy wiedzy. Cenniki, procedury i oferta się zmieniają, a bot odpowiada z tego, co dostał. Rynkowo 500⁠–⁠2000 zł na kwartał.

Do tego dochodzi opcjonalna opieka utrzymaniowa u wykonawcy (retainer): w polskich cennikach 1⁠–⁠3 tys. zł miesięcznie. W sumie prosty chatbot w małej firmie zamyka się zwykle w 200⁠–⁠1000 zł miesięcznie, a pełne abonamenty „wdrożenie plus opieka” u wyspecjalizowanych dostawców kosztują 900⁠–⁠2200 zł.

Ile kosztują tokeny (stan na lipiec 2026)

Kwoty z oficjalnych cenników trzech głównych dostawców, w dolarach za milion tokenów (wejście / wyjście), odczytane 29 lipca 2026. To jedyna tabela w tym serwisie, która dezaktualizuje się z tygodnia na tydzień, więc przed wyceną sprawdź cennik u dostawcy:

Model Wejście Wyjście
Gemini 2.5 Flash-Lite 0,10 USD 0,40 USD
GPT-5.4-mini 0,75 USD 4,50 USD
Claude Haiku 4.5 1 USD 5 USD
Gemini 3.5 Flash 1,50 USD 9 USD
GPT-5.4 2,50 USD 15 USD
Claude Opus 5 5 USD 25 USD
Claude Fable 5 10 USD 50 USD

Dwie uwagi do tej tabeli. Po pierwsze, ceny są w dolarach, więc rachunek w złotych zależy od kursu w dniu rozliczenia. Po drugie, przeliczanie „ceny za milion tokenów” na własny budżet wymaga założeń o długości rozmów; oficjalny przykład Anthropic: 10 tysięcy zgłoszeń supportu na Haiku 4.5, średnio 3700 tokenów na rozmowę, to około 37 dolarów. Warto wiedzieć, jak ta kwota powstaje: 37 milionów tokenów rozliczonych po stawce wejścia (1 USD za milion). Odpowiedzi modelu kosztują pięć razy więcej niż wejście i dolicza się je osobno: dwieście tokenów odpowiedzi na rozmowę to 2 miliony tokenów po 5 USD za milion, czyli 10 dolarów. Realny rachunek wychodzi więc bliżej 47 dolarów. Polskie źródła podają zbieżny rząd wielkości: 0,01⁠–⁠0,10 zł za rozmowę, a StormIT wskazuje, że typowy rachunek za API u jego klientów to 50⁠–⁠300 zł miesięcznie.

Przy typowym ruchu na firmowej stronie tokeny są więc tanie. Drogo robi się przy dużej skali, od dziesiątek tysięcy rozmów wzwyż, oraz przy agentach, które na jedno zadanie zużywają wielokrotnie więcej tokenów niż chatbot na jedną odpowiedź.

Jak obniżyć rachunek, zanim urośnie

Na rachunek za tokeny wpływa się trzema mechanizmami. Wszystkie pochodzą wprost z oficjalnych cenników, więc o każdy można zapytać wykonawcę i zweryfikować odpowiedź w architekturze rozwiązania.

Pierwszy to cache promptu: powtarzalna część kontekstu, na przykład instrukcja systemowa z opisem firmy, może być odczytywana z pamięci podręcznej taniej niż zwykłe wejście. Standardowa stawka to często około jednej dziesiątej ceny wejścia, ale zależy od modelu. W Claude Fable 5.1 — oraz limitowanym Mythos 5.1 — odczyt kosztuje 0,25 USD wobec 10 USD za milion zwykłych tokenów wejścia, czyli 2,5%. Pozostałe modele Anthropic zachowują standardowe 10%. U Google dochodzi do tego opłata za przechowywanie liczona godzinowo. Cache nie jest jednak darmowy z drugiej strony: sam zapis kosztuje więcej niż zwykłe wejście (u Anthropic 1,25 raza przy pięciominutowym czasie życia wpisu i dwa razy przy godzinnym), a wpis po tym czasie wygasa. Zwraca się więc dopiero wtedy, gdy rozmowy przychodzą gęściej, niż wynosi czas życia wpisu; przy ruchu rozrzuconym w czasie większość wywołań zapłaci za zapis i trafi w pustkę. Chatbot z długim promptem i dużym natężeniem rozmów bez cache przepłaca, przy kilku rozmowach dziennie cache potrafi rachunek podnieść. Drugi to tryb wsadowy, o połowę tańszy; nadaje się do zadań, na które nikt nie czeka, choćby nocnego przetwarzania dokumentów. Trzeci, w praktyce najważniejszy, to dobór modelu do kroku. Różnica ceny między modelem flagowym a lekkim tego samego dostawcy to w tej tabeli od nieco ponad trzykrotności u OpenAI do dziesięciokrotności u Anthropic (Google ma tu wyłącznie modele klasy lekkiej), a między krańcami całego zestawienia, od najlżejszego modelu Google do najdroższego Anthropic, rozpiętość sięga dwóch rzędów wielkości. Proste pytanie nie potrzebuje najdroższego modelu.

Warto też wiedzieć, że ceny w tej samej klasie modeli spadają między generacjami: w linii Opus cena spadła z 15/75 USD za milion tokenów do 5/25 USD. Nie zakładałbym na tej podstawie konkretnego tempa spadków, ale projektując rozwiązanie, warto przewidzieć łatwą wymianę modelu na nowszy.

Pułapka porównań: te same słowa, różne zakresy

Kwoty „utrzymania miesięcznego” w różnych ofertach obejmują różne rzeczy. 200⁠–⁠1000 zł u jednego dostawcy to samo API z hostingiem. 900⁠–⁠2200 zł u innego to pełny abonament z opieką i rozwojem. 0⁠–⁠200 zł w cennikach narzędzi abonamentowych to widget bez integracji, a prawdziwy koszt pojawia się przy przejściu na wyższy plan. Kto zestawia te liczby wprost, porównuje widget z pełną usługą.

Praktyczna rada z tekstu o kosztach chatbota obowiązuje i tutaj: proś o oszacowanie kosztu miesięcznego dla dwóch scenariuszy ruchu, obecnego i trzykrotnie wyższego, z podanymi założeniami co do modelu i długości rozmów. Wykonawca, który nie umie tego policzyć, nie kontroluje pozycji, która będzie rosła najszybciej.

Najczęstsze pytania

Co składa się na miesięczny koszt utrzymania AI?
Cztery pozycje: opłaty za API modelu językowego naliczane od tokenów (jedyna pozycja rosnąca z użyciem), hosting i infrastruktura (rynkowo 50⁠–⁠500 zł miesięcznie), monitoring jakości odpowiedzi (2⁠–⁠4 godziny pracy tygodniowo) oraz aktualizacja bazy wiedzy (500⁠–⁠2000 zł na kwartał). Osobną, opcjonalną pozycją jest opieka utrzymaniowa u wykonawcy, w polskich cennikach 1⁠–⁠3 tys. zł miesięcznie.
Ile kosztuje API przy 1000 rozmów chatbota miesięcznie?
Według polskich cenników z 2026 roku około 0,01⁠–⁠0,10 zł za rozmowę, czyli 10⁠–⁠100 zł przy tysiącu rozmów. Oficjalny przykład Anthropic daje podobny rząd wielkości: obsłużenie 10 tysięcy zgłoszeń supportu na modelu Haiku 4.5, przy średnio 3700 tokenach na rozmowę, to około 37 dolarów liczone po stawce wejścia; odpowiedzi modelu dolicza się osobno, po pięciokrotnie wyższej stawce, co przy dwustu tokenach na rozmowę daje razem około 47 dolarów. Rachunek zależy od modelu i długości rozmów, więc przy wycenie zawsze proś o założenia.
Które koszty AI rosną z użyciem, a które są stałe?
Z użyciem rośnie API: podwojenie liczby rozmów podwaja rachunek za tokeny, a dodatkowe narzędzia typu wyszukiwanie internetowe są rozliczane od wywołania. Względnie stałe są hosting, monitoring i aktualizacja bazy wiedzy. Dlatego przy małym ruchu dominują koszty stałe, a przy dużym niemal cały rachunek to tokeny i wtedy zaczyna się opłacać optymalizacja.
Jak obniżyć miesięczny rachunek za API modelu?
Trzy dźwignie z oficjalnych cenników: cache powtarzalnego promptu, tryb wsadowy dla zadań, na które nikt nie czeka (50% zniżki), i dobór modelu do zadania. Odczyt cache kosztuje zwykle około jednej dziesiątej ceny wejścia, ale są wyjątki zależne od modelu: w Claude Fable 5.1 to 0,25 USD wobec 10 USD za milion tokenów wejścia, czyli 2,5%. Zapis kosztuje więcej niż zwykłe wejście, dlatego cache opłaca się przy gęstym ruchu. W praktyce najwięcej daje dobór modelu: prosty krok nie potrzebuje najdroższego wariantu.

Źródła

Dane zewnętrzne przywołane w tekście mają tu swoje źródła.

  1. Anthropic — oficjalny cennik API Claude (stan: 4.09.2026; Fable 5.1: odczyt cache 0,25 USD przy wejściu 10 USD za mln tokenów) (nowa karta)
  2. OpenAI — oficjalny cennik API (stan: lipiec 2026) (nowa karta)
  3. Google — oficjalny cennik Gemini API (stan: lipiec 2026) (nowa karta)
  4. StormIT — Ile kosztuje wdrożenie AI w firmie (18.02.2026) (nowa karta)
  5. LessManual — Ile kosztuje chatbot AI w Polsce (02.03.2026) (nowa karta)
  6. Gagan.pl — Ile kosztuje chatbot AI: cena, wdrożenie i realne koszty 2026 (22.03.2026) (nowa karta)

Udostępnij

Powiązane

Masz konkretny proces do omówienia?

Napisz, jaki to proces i ile razy w miesiącu się powtarza. Odpowiem, czy nadaje się do automatyzacji, również wtedy, gdy odpowiedź brzmi „nie warto”.

Albo prosto na adres: not-a-bot@ekspertodsztucznejinteligencji.pl