# Ile kosztuje utrzymanie AI miesięcznie?

> Miesięczny koszt utrzymania rozwiązania AI dzieli się na pozycję rosnącą z użyciem, czyli opłaty za API modelu, i pozycje względnie stałe: hosting, monitoring oraz aktualizację bazy wiedzy. Prosty chatbot przy typowym ruchu na stronie firmowej zamyka się według polskich cenników z 2026 roku w 200–1000 zł miesięcznie.

Autor: Robert Marczyński · Opublikowano: 2026-07-28 · Aktualizacja: 2026-09-04
Kanoniczny URL: https://ekspertodsztucznejinteligencji.pl/odpowiedzi/ile-kosztuje-utrzymanie-ai

## Z czego składa się rachunek miesięczny

Utrzymanie to pozycja, o której budżety wdrożeń zapominają najczęściej, bo w klasycznych projektach IT nie miała odpowiednika. Rozkłada się na cztery części:

- **API modelu językowego.** Opłata od przetworzonych tokenów, naliczana przy każdym użyciu. Jedyna pozycja, która rośnie proporcjonalnie do ruchu.
- **Hosting i infrastruktura.** Rynkowo 50–500 zł miesięcznie za serwer przy rozwiązaniu szytym na miarę; w narzędziach abonamentowych wliczone w cenę.
- **Monitoring.** Ktoś musi patrzeć, czy odpowiedzi nie zjeżdżają z jakości. Polskie źródła podają 2–4 godziny pracy tygodniowo, co pokrywa się z tym, co widzę w projektach.
- **Aktualizacja bazy wiedzy.** Cenniki, procedury i oferta się zmieniają, a bot odpowiada z tego, co dostał. Rynkowo 500–2000 zł na kwartał.

Do tego dochodzi opcjonalna **opieka utrzymaniowa u wykonawcy** (retainer): w polskich cennikach 1–3 tys. zł miesięcznie. W sumie prosty chatbot w małej firmie zamyka się zwykle w 200–1000 zł miesięcznie, a pełne abonamenty „wdrożenie plus opieka” u wyspecjalizowanych dostawców kosztują 900–2200 zł.

## Ile kosztują tokeny (stan na lipiec 2026)

Kwoty z oficjalnych cenników trzech głównych dostawców, w dolarach za milion tokenów (wejście / wyjście), odczytane 29 lipca 2026. To jedyna tabela w tym serwisie, która dezaktualizuje się z tygodnia na tydzień, więc przed wyceną sprawdź cennik u dostawcy:

| Model | Wejście | Wyjście |
| --- | --- | --- |
| Gemini 2.5 Flash-Lite | 0,10 USD | 0,40 USD |
| GPT-5.4-mini | 0,75 USD | 4,50 USD |
| Claude Haiku 4.5 | 1 USD | 5 USD |
| Gemini 3.5 Flash | 1,50 USD | 9 USD |
| GPT-5.4 | 2,50 USD | 15 USD |
| Claude Opus 5 | 5 USD | 25 USD |
| Claude Fable 5 | 10 USD | 50 USD |

Dwie uwagi do tej tabeli. Po pierwsze, ceny są w dolarach, więc rachunek w złotych zależy od kursu w dniu rozliczenia. Po drugie, przeliczanie „ceny za milion tokenów” na własny budżet wymaga założeń o długości rozmów; oficjalny przykład Anthropic: **10 tysięcy zgłoszeń supportu na Haiku 4.5, średnio 3700 tokenów na rozmowę, to około 37 dolarów**. Warto wiedzieć, jak ta kwota powstaje: 37 milionów tokenów rozliczonych po stawce wejścia (1 USD za milion). Odpowiedzi modelu kosztują pięć razy więcej niż wejście i dolicza się je osobno: dwieście tokenów odpowiedzi na rozmowę to 2 miliony tokenów po 5 USD za milion, czyli 10 dolarów. Realny rachunek wychodzi więc bliżej 47 dolarów. Polskie źródła podają zbieżny rząd wielkości: 0,01–0,10 zł za rozmowę, a StormIT wskazuje, że typowy rachunek za API u jego klientów to 50–300 zł miesięcznie.

Przy typowym ruchu na firmowej stronie tokeny są więc tanie. Drogo robi się przy dużej skali, od dziesiątek tysięcy rozmów wzwyż, oraz przy [agentach](/odpowiedzi/ile-kosztuje-agent-ai), które na jedno zadanie zużywają wielokrotnie więcej tokenów niż chatbot na jedną odpowiedź.

## Jak obniżyć rachunek, zanim urośnie

Na rachunek za tokeny wpływa się trzema mechanizmami. Wszystkie pochodzą wprost z oficjalnych cenników, więc o każdy można zapytać wykonawcę i zweryfikować odpowiedź w architekturze rozwiązania.

Pierwszy to cache promptu: powtarzalna część kontekstu, na przykład instrukcja systemowa z opisem firmy, może być odczytywana z pamięci podręcznej taniej niż zwykłe wejście. Standardowa stawka to często około jednej dziesiątej ceny wejścia, ale zależy od modelu. W Claude Fable 5.1 — oraz limitowanym Mythos 5.1 — odczyt kosztuje 0,25 USD wobec 10 USD za milion zwykłych tokenów wejścia, czyli **2,5%**. Pozostałe modele Anthropic zachowują standardowe 10%. U Google dochodzi do tego opłata za przechowywanie liczona godzinowo. Cache nie jest jednak darmowy z drugiej strony: sam zapis kosztuje więcej niż zwykłe wejście (u Anthropic 1,25 raza przy pięciominutowym czasie życia wpisu i dwa razy przy godzinnym), a wpis po tym czasie wygasa. Zwraca się więc dopiero wtedy, gdy rozmowy przychodzą gęściej, niż wynosi czas życia wpisu; przy ruchu rozrzuconym w czasie większość wywołań zapłaci za zapis i trafi w pustkę. Chatbot z długim promptem i dużym natężeniem rozmów bez cache przepłaca, przy kilku rozmowach dziennie cache potrafi rachunek podnieść. Drugi to tryb wsadowy, o połowę tańszy; nadaje się do zadań, na które nikt nie czeka, choćby nocnego przetwarzania dokumentów. Trzeci, w praktyce najważniejszy, to dobór modelu do kroku. Różnica ceny między modelem flagowym a lekkim tego samego dostawcy to w tej tabeli od nieco ponad trzykrotności u OpenAI do dziesięciokrotności u Anthropic (Google ma tu wyłącznie modele klasy lekkiej), a między krańcami całego zestawienia, od najlżejszego modelu Google do najdroższego Anthropic, rozpiętość sięga dwóch rzędów wielkości. Proste pytanie nie potrzebuje najdroższego modelu.

Warto też wiedzieć, że ceny w tej samej klasie modeli spadają między generacjami: w linii Opus cena spadła z 15/75 USD za milion tokenów do 5/25 USD. Nie zakładałbym na tej podstawie konkretnego tempa spadków, ale projektując rozwiązanie, warto przewidzieć łatwą wymianę modelu na nowszy.

## Pułapka porównań: te same słowa, różne zakresy

Kwoty „utrzymania miesięcznego” w różnych ofertach obejmują różne rzeczy. 200–1000 zł u jednego dostawcy to samo API z hostingiem. 900–2200 zł u innego to pełny abonament z opieką i rozwojem. 0–200 zł w cennikach narzędzi abonamentowych to widget bez integracji, a prawdziwy koszt pojawia się przy przejściu na wyższy plan. Kto zestawia te liczby wprost, porównuje widget z pełną usługą.

Praktyczna rada z tekstu o [kosztach chatbota](/odpowiedzi/ile-kosztuje-chatbot-ai) obowiązuje i tutaj: proś o oszacowanie kosztu miesięcznego dla dwóch scenariuszy ruchu, obecnego i trzykrotnie wyższego, z podanymi założeniami co do modelu i długości rozmów. Wykonawca, który nie umie tego policzyć, nie kontroluje pozycji, która będzie rosła najszybciej.

## Najczęstsze pytania

**Co składa się na miesięczny koszt utrzymania AI?**

Cztery pozycje: opłaty za API modelu językowego naliczane od tokenów (jedyna pozycja rosnąca z użyciem), hosting i infrastruktura (rynkowo 50–500 zł miesięcznie), monitoring jakości odpowiedzi (2–4 godziny pracy tygodniowo) oraz aktualizacja bazy wiedzy (500–2000 zł na kwartał). Osobną, opcjonalną pozycją jest opieka utrzymaniowa u wykonawcy, w polskich cennikach 1–3 tys. zł miesięcznie.

**Ile kosztuje API przy 1000 rozmów chatbota miesięcznie?**

Według polskich cenników z 2026 roku około 0,01–0,10 zł za rozmowę, czyli 10–100 zł przy tysiącu rozmów. Oficjalny przykład Anthropic daje podobny rząd wielkości: obsłużenie 10 tysięcy zgłoszeń supportu na modelu Haiku 4.5, przy średnio 3700 tokenach na rozmowę, to około 37 dolarów liczone po stawce wejścia; odpowiedzi modelu dolicza się osobno, po pięciokrotnie wyższej stawce, co przy dwustu tokenach na rozmowę daje razem około 47 dolarów. Rachunek zależy od modelu i długości rozmów, więc przy wycenie zawsze proś o założenia.

**Które koszty AI rosną z użyciem, a które są stałe?**

Z użyciem rośnie API: podwojenie liczby rozmów podwaja rachunek za tokeny, a dodatkowe narzędzia typu wyszukiwanie internetowe są rozliczane od wywołania. Względnie stałe są hosting, monitoring i aktualizacja bazy wiedzy. Dlatego przy małym ruchu dominują koszty stałe, a przy dużym niemal cały rachunek to tokeny i wtedy zaczyna się opłacać optymalizacja.

**Jak obniżyć miesięczny rachunek za API modelu?**

Trzy dźwignie z oficjalnych cenników: cache powtarzalnego promptu, tryb wsadowy dla zadań, na które nikt nie czeka (50% zniżki), i dobór modelu do zadania. Odczyt cache kosztuje zwykle około jednej dziesiątej ceny wejścia, ale są wyjątki zależne od modelu: w Claude Fable 5.1 to 0,25 USD wobec 10 USD za milion tokenów wejścia, czyli 2,5%. Zapis kosztuje więcej niż zwykłe wejście, dlatego cache opłaca się przy gęstym ruchu. W praktyce najwięcej daje dobór modelu: prosty krok nie potrzebuje najdroższego wariantu.


## Źródła

- Anthropic — oficjalny cennik API Claude (stan: 4.09.2026; Fable 5.1: odczyt cache 0,25 USD przy wejściu 10 USD za mln tokenów): https://platform.claude.com/docs/en/about-claude/pricing
- OpenAI — oficjalny cennik API (stan: lipiec 2026): https://developers.openai.com/api/docs/pricing
- Google — oficjalny cennik Gemini API (stan: lipiec 2026): https://ai.google.dev/pricing
- StormIT — Ile kosztuje wdrożenie AI w firmie (18.02.2026): https://stormit.pl/ile-kosztuje-wdrozenie-ai
- LessManual — Ile kosztuje chatbot AI w Polsce (02.03.2026): https://www.lessmanual.ai/blog/ile-kosztuje-chatbot-ai-polska
- Gagan.pl — Ile kosztuje chatbot AI: cena, wdrożenie i realne koszty 2026 (22.03.2026): https://www.gagan.pl/wiedza/automatyzacje/ile-kosztuje-chatbot-ai-cena-wdrozenie-i-realne-koszty-2026
