Claude Fable 5.1: ceny bazowe bez zmian, na tańszym cache zyskają głównie agenci
Anthropic wydał 1 września 2026 Claude Fable 5.1 i Mythos 5.1. Ceny bazowe API nie zmieniły się względem Fable 5 (10 USD za milion tokenów wejścia, 50 USD za wyjście), a jedyną zmianą cennikową jest odczyt z cache, tańszy o 75% (0,25 USD zamiast 1,00 USD za milion tokenów). Deklarowane przez producenta oszczędności, ok. 25% przy typowych obciążeniach i do ok. 45% przy agentowych, wynikają z tej obniżki i z mniejszego zużycia tokenów, dotyczą więc głównie długiego kontekstu czytanego wielokrotnie, a nie pojedynczych zapytań. Największe skoki w benchmarkach to Terminal-Bench-Science z 24,7% do 52,6% i AutomationBench z 17,1% do 31,4%, ale to liczby producenta z dnia premiery, bez niezależnych replikacji. Mythos 5.1 to ten sam model z innymi zabezpieczeniami, dostępny na razie wyłącznie dla zweryfikowanych organizacji z USA, więc polska firma pracuje na Fable. Wyjścia modeli wydanych po 2 sierpnia 2026 noszą niewidoczny znak wodny, który Anthropic wiąże z EU AI Act.
Robert Marczyński11 min czytania5 źródeł
Anthropic wydał 1 września 2026 Claude Fable 5.1 i Mythos 5.1, niecałe trzy miesiące po premierze Fable 5 z 9 czerwca. Dla firmy, która płaci za API, najważniejsze zdanie z tego ogłoszenia dotyczy cennika: stawki bazowe się nie zmieniły. Wejście kosztuje 10 USD za milion tokenów, wyjście 50 USD, dokładnie jak w Fable 5. Drgnęła jedna pozycja — odczyt z cache, z 1,00 USD do 0,25 USD za milion tokenów, czyli −75%. Z tej obniżki i z deklarowanego mniejszego zużycia tokenów Anthropic wyprowadza oszczędności ok. 25% przy typowych obciążeniach i do ok. 45% przy agentowych. Kto wysyła pojedyncze zapytania bez cache, zapłaci za token tyle samo co przed premierą.
Zastrzeżenie na początek, bo piszę dzień po ogłoszeniu: wszystkie liczby o jakości modelu w tym tekście pochodzą od Anthropic. Niezależnych replikacji jeszcze nie ma, sam też nie zdążyłem 5.1 przetestować. Ten tekst rozbiera ogłoszenie i cennik; testy przyjdą później. (Nawet dzień premiery wymaga przypisu: ogłoszenie Anthropic nosi tylko datę „September 2026”, a 1 września potwierdza relacja VentureBeat z tego dnia.)
Cennik: stawki bazowe stoją, taniej robi się w cache
Cennik Anthropic, stan z 2 września 2026, dopisuje do liczb z leadu kilka pozycji. Nowa stawka odczytu z cache to 2,5% ceny wejścia zamiast dotychczasowych 10%. Zapis do cache kosztuje tyle co wcześniej: 12,50 USD za milion przy cache pięciominutowym i 20 USD przy godzinnym. Batch API wycenia Fable 5.1 na 5 USD za wejście i 25 USD za wyjście. W API model działa pod identyfikatorem claude-fable-5-1; według dokumentacji modeli Anthropic z tego samego dnia okno kontekstu to bez zmian milion tokenów, a limit wyjścia — 128 tys. tokenów.
Mechanika oszczędności jest prosta. Agent wykonujący zadanie w pętli przy każdym kroku odsyła do modelu niemal ten sam, długi kontekst: te same instrukcje i całą dotychczasową historię rozmowy z przeczytanymi po drodze plikami. Przy dobrze ustawionym cache ogromna większość tych tokenów to właśnie odczyty z cache, więc gdy ta pozycja tanieje czterokrotnie, rachunek agenta spada, choć stawki bazowe stoją w miejscu.
Stąd moja rada, zanim ktokolwiek uwierzy w 25–45%: policz własny rozkład, i to w kwotach, nie w liczbie tokenów. Token wyjścia jest 200 razy droższy od tokenu odczytu z cache (50 USD wobec 0,25 USD za milion), więc nawet tam, gdzie odczyty cache dominują liczbowo, w kwocie rachunku ważą znacznie mniej. W rozliczeniu API widać osobno pozycje za wejście, wyjście, zapis do cache i odczyty z cache. Oszczędność z tej obniżki to 75% pomnożone przez udział odczytów cache w kwocie: przy połowie kwoty rozliczenia z całości zejdzie 37,5%, a pełne −75% dopiero wtedy, gdy odczyty robią niemal cały rachunek. Jeśli to kilka procent kwoty — jak w czacie, który zadaje jedno pytanie i dostaje jedną odpowiedź — po stronie cennika nie zmienia się dla Ciebie nic. Zostaje deklarowane mniejsze zużycie tokenów, o ile potwierdzi się w praktyce.
Benchmarki: liczby producenta, największe skoki w terminalu i automatyzacji
Wszystkie wartości poniżej pochodzą z ogłoszenia Anthropic z 1 września 2026.
| Benchmark | Co mierzy | Fable 5 | Fable 5.1 |
|---|---|---|---|
| Terminal-Bench 4.0 | pracę agenta z zadaniami w wierszu poleceń | 42,0% | 55,8% |
| Terminal-Bench-Science 0.1 | zadania badawcze wykonywane w terminalu, np. analizę danych | 24,7% | 52,6% |
| AutomationBench | automatyzację wieloetapowych zadań roboczych od początku do końca | 17,1% | 31,4% |
| GDPval-AA v2 | porównawczą jakość wykonania zadań zawodowych o wartości ekonomicznej | 1723 pkt Elo | 1853 pkt Elo |
| OSWorld 2.0 (partial) | obsługę komputera przez interfejs graficzny, z zaliczeniem częściowym | 72,9% | 77,9% |
| OSWorld 2.0 (strict) | to samo przy wymogu pełnego wykonania zadania | 36,1% | 41,7% |
| Humanity’s Last Exam (bez narzędzi) | trudne pytania eksperckie z wielu dziedzin | 57,8% | 60,9% |
| Humanity’s Last Exam (z narzędziami) | te same pytania z dostępem do wyszukiwania i narzędzi | 63,8% | 65,0% |
| CursorBench 3.2.0 | zadania programistyczne wykonywane przez agenta kodowania | 70,5% | 73,4% |
Dwa skoki wybijają się ponad resztę. Terminal-Bench-Science urósł z 24,7% do 52,6%, czyli ponad dwukrotnie; AutomationBench z 17,1% do 31,4%. Oba startowały z niskiej bazy, więc o duży względny przyrost było tu łatwiej niż w nasyconych testach, i oba celują dokładnie w to, na czym Anthropic buduje narrację o agentach wykonujących pracę bez nadzoru. Tuż za nimi idzie Terminal-Bench 4.0: z 42,0% do 55,8%, czyli o 13,8 punktu procentowego, niemal tyle samo co 14,3 punktu w AutomationBench, tylko od wyższej podstawy.
Osobno stoi GDPval-AA v2, liczony w punktach Elo, nie w procentach. Wzrost o 130 punktów, z 1723 na 1853, to również jeden z większych deklarowanych skoków tej premiery (w standardowej interpretacji skali Elo odpowiadałby blisko 68% preferencji w porównaniach parami — to moje przybliżenie, ogłoszenie takiej skali nie deklaruje).
Reszta tabeli to przyrosty o kilka punktów procentowych. Porządne, ale niezmieniające obrazu modelu.
Zabezpieczenia rzadziej blokują nieszkodliwe pytania
Druga oś tej premiery to fałszywe blokady — i tu ważny niuans: to zmiana w zabezpieczeniach, nie w samym modelu. Anthropic wymienił przy premierze filtry i deklaruje, że nowe zabezpieczenia biologiczne, obejmujące zarówno Fable 5.1, jak i Fable 5, odzywają się o 85% rzadziej przy nieszkodliwych, prostych pytaniach biologicznych i medycznych, względem filtrów z czerwcowej premiery Fable 5. Użytkownicy Claude Code mają z kolei widzieć średnio ok. 60% mniej interwencji zabezpieczeń cybernetycznych na sesję, także względem poprzednich filtrów. Polityka użycia dopuściła też jawnie wykrywanie podatności w oprogramowaniu, bez tworzenia exploitów.
Ta akurat poprawa nie jest więc argumentem za migracją — dostaje ją również ten, kto zostaje na starym modelu. W codziennej pracy i tak jest to konkret. Zespół robiący analizy w biotechu albo audyt bezpieczeństwa rzadziej trafi na odmowę przy pytaniu, w którym nie ma niczego groźnego, a przerwana sesja agenta kosztuje realne pieniądze: przebieg trzeba powtórzyć i drugi raz zapłacić za tokeny.
Mythos 5.1 zostaje w USA, polska firma pracuje na Fable
Mythos 5.1 to według Anthropic ten sam model co Fable 5.1, z innymi poziomami zabezpieczeń. Dostęp prowadzi przez programy weryfikacyjne Cyber Verification Program i Life Sciences Verification Program, a na dzień premiery obejmuje wyłącznie organizacje z USA. Wniosek dla polskiego rynku mieści się w jednym zdaniu: kupujesz Fable 5.1 i na nim liczysz koszty.
Dla polskiej firmy z restrykcyjną umową o retencji danych ważniejsza od samego Mythosa może być druga zapowiedź z tej premiery: Enterprise Frontier Safeguards, czyli wykrywanie nadużyć bez oddawania danych monitoringu do Anthropic. Ogłoszenie mówi o programie powstałym we współpracy z AWS, Google Cloud i Microsoft Azure oraz o wdrożeniu etapami od jesieni 2026; szczegóły architektury opisuje relacja VentureBeat z 1 września. Dane monitoringu zostają we własnym środowisku klienta w jednej z tych chmur, pod kluczami szyfrującymi, politykami dostępu i dziennikami audytu, którymi zarządza klient; do czasu startu uprawnione firmy dostają 5.1 w trybie zero data retention. To na razie zapowiedź, ale z architekturą po stronie klienta i datą startu, którą da się wpisać do kalendarza.
Znak wodny w wyjściach obejmie każdego, kto publikuje treści z modelu
W relacjach z premiery ten wątek ginie za benchmarkami, a dla rynku UE jest najpraktyczniejszy: Anthropic ogłosił, że wyjścia modeli wydanych po 2 sierpnia 2026 noszą niewidoczny znak wodny, co firma wiąże z obowiązkami przejrzystości EU AI Act. Cezura powinna działać w obie strony — tak czytam komunikat, który mówi wyłącznie o modelach wydanych po tej dacie: wyjścia wcześniejszych, w tym Fable 5, na którym wiele firm pracuje dziś, znaku nosić nie powinny. Jeśli ten wniosek się utrzyma, migracja na 5.1 to także decyzja o wykrywalności publikowanych treści, obok kosztu i jakości. Uzupełnieniem jest Detection API, na razie dla uprawnionych organizacji — m.in. regulatorów, organów ścigania, mediów, fact-checkerów i niezależnych badaczy; osobną ścieżkę mają firmy, a Anthropic zapowiada stopniowe poszerzanie dostępu do tego API.
Treść wygenerowana przez Fable 5.1 staje się więc, przynajmniej dla tego grona, technicznie rozpoznawalna. Firma, która publikuje teksty z modeli i zakłada, że nikt tego nie sprawdzi, właśnie dostała powód, by przemyśleć, jak oznaczać treści AI, zanim zainteresuje się tym ktoś z listy uprawnionych. O odporności samego znaku na parafrazę czy tłumaczenie ogłoszenie nie mówi nic, więc wstrzymuję się z wnioskami w którąkolwiek stronę.
Komu ta aktualizacja zmienia rachunek od razu
Aktualizacja od razu ma znaczenie tam, gdzie pracują agenci na długim kontekście, i wszędzie, gdzie przez API idzie duży wolumen — także przez Batch API. W takich obciążeniach podmiana identyfikatora modelu na claude-fable-5-1 i tydzień obserwacji rozliczenia dadzą odpowiedź lepszą niż każdy tekst z dnia premiery, mój włącznie. Co poza modelem składa się na koszt agenta, policzyłem w osobnej odpowiedzi, a rachunek utrzymania AI rozpisałem oddzielnie. Sam wybór nie jest przy tym zero-jedynkowy w czasie: według ogłoszenia 5.1 jest od premiery dostępny na wszystkich platformach, w tym w Amazon Web Services, Google Cloud i Microsoft Azure, a Fable 5 figuruje w dokumentacji Anthropic jako model nadal dostępny (stan z 2 września 2026) — pozostanie przy nim to opcja, nie przymus.
Przy pojedynczych zapytaniach bez cache cenowo nie zmienia się nic, a jakościowo tyle, ile pokażą niezależne testy. W takiej sytuacji nie widzę powodu do migracji w dniu premiery; odczekanie dwóch tygodni na cudze pomiary bywa tańsze niż własny pilotaż na gorąco.
Na koniec rzecz szersza niż jedna premiera: rachunek „własny model czy API” po tym ogłoszeniu przechyla się odrobinę w stronę API, bo deklarowana jakość rośnie przy niższym koszcie odczytu. Wrócę do tematu, gdy będę miał własne pomiary; do tego czasu traktuję 25–45% jak każdą obietnicę z dnia premiery, czyli jak hipotezę do sprawdzenia na własnym rozliczeniu.
Najczęstsze pytania
- Ile kosztuje Claude Fable 5.1 w API?
- Według cennika Anthropic (odczyt z 2 września 2026, dzień po premierze) stawki bazowe są takie same jak w Fable 5: 10 USD za milion tokenów wejścia i 50 USD za milion tokenów wyjścia. Zmienił się tylko odczyt z cache: 0,25 USD za milion tokenów zamiast 1,00 USD, czyli o 75% mniej. Zapis do cache kosztuje bez zmian 12,50 USD za milion przy cache pięciominutowym i 20 USD przy godzinnym, a Batch API 5 USD za wejście i 25 USD za wyjście.
- Skąd się biorą oszczędności 25–45%, skoro ceny bazowe się nie zmieniły?
- Z dwóch źródeł, oba według deklaracji Anthropic z 1 września 2026: odczyt z cache staniał o 75% (z 1,00 USD do 0,25 USD za milion tokenów), a model ma zużywać mniej tokenów na te same zadania. Ok. 25% dotyczy typowych obciążeń, do ok. 45% agentowych, bo agent przy każdym kroku czyta ten sam długi kontekst i odczyty cache robią większość wolumenu jego tokenów — ile z tego widać w kwocie rachunku, zależy od udziału droższych tokenów wyjścia. Przy pojedynczym zapytaniu bez cache stawki za token są dokładnie te same co w Fable 5, a rachunek zmieni się najwyżej o tyle, o ile model faktycznie zużyje mniej tokenów.
- Czy wyniki benchmarków Claude Fable 5.1 są niezależnie potwierdzone?
- Nie. Wszystkie porównania z Fable 5 pochodzą z materiałów Anthropic z 1 września 2026, a do 2 września 2026 nie znalazłem niezależnych replikacji, co przy premierze sprzed jednego dnia jest normalne. Największe deklarowane skoki to Terminal-Bench-Science z 24,7% do 52,6% i AutomationBench z 17,1% do 31,4%; mniejsze przyrosty dotyczą m.in. OSWorld 2.0 (77,9% wobec 72,9% w wariancie partial) i Humanity’s Last Exam (60,9% wobec 57,8% bez narzędzi).
- Czym Mythos 5.1 różni się od Fable 5.1 i czy kupię go w Polsce?
- Według Anthropic to ten sam model z innymi poziomami zabezpieczeń, dostępny przez programy weryfikacyjne Cyber Verification Program i Life Sciences Verification Program, na dzień premiery (1 września 2026) wyłącznie dla organizacji z USA. Polska firma pracuje więc na Fable 5.1; w API model nazywa się claude-fable-5-1.
- Czy treści z Claude Fable 5.1 mają znak wodny?
- Tak. Anthropic ogłosił 1 września 2026, że wyjścia modeli wydanych po 2 sierpnia 2026 noszą niewidoczny znak wodny, co firma wiąże z obowiązkami przejrzystości EU AI Act. Do tego dochodzi Detection API, na razie dla uprawnionych organizacji, m.in. regulatorów, organów ścigania, mediów, fact-checkerów i niezależnych badaczy; osobny dostęp mają firmy. Zwykły czytelnik znaku nie zobaczy, ale wykrywalność treści z modelu przestaje być czysto teoretyczna.
- Co zmieniają rzadsze fałszywe blokady przy premierze Fable 5.1?
- Anthropic wymienił przy premierze 1 września 2026 zabezpieczenia i deklaruje, że nowe filtry biologiczne, obejmujące zarówno Fable 5.1, jak i Fable 5, odzywają się o 85% rzadziej przy nieszkodliwych, prostych pytaniach biologicznych i medycznych (względem filtrów z premiery Fable 5), a użytkownicy Claude Code mają widzieć średnio ok. 60% mniej interwencji zabezpieczeń cybernetycznych na sesję. Do polityki użycia doszło jawnie dozwolone wykrywanie podatności w oprogramowaniu, bez tworzenia exploitów. Obie liczby pochodzą od producenta; poprawa filtrów biologicznych objęła także Fable 5, więc akurat ona nie wymaga migracji.
Źródła
Dane zewnętrzne przywołane w tekście mają tu swoje źródła.
- Anthropic — ogłoszenie Claude Fable 5.1 i Mythos 5.1: cennik, benchmarki, deklarowane oszczędności 25–45%, znak wodny i programy weryfikacyjne (wrzesień 2026) (nowa karta)
- Anthropic — cennik API: stawki Fable 5.1, odczyt cache 0,25 USD/mln, zapis do cache, Batch API (odczyt z 2.09.2026) (nowa karta)
- Anthropic — przegląd modeli: okno kontekstu 1 mln tokenów i limit wyjścia 128 tys. dla Fable 5.1 (odczyt z 2.09.2026) (nowa karta)
- Anthropic — ogłoszenie Claude Fable 5 i Mythos 5: ceny bazowe 10/50 USD za mln tokenów (9.06.2026) (nowa karta)
- VentureBeat — relacja z premiery Fable 5.1: obniżka odczytu cache o 75%, Enterprise Frontier Safeguards w AWS, Azure i Google Cloud; potwierdza dzień premiery (1.09.2026) (nowa karta)
Udostępnij
Powiązane
- Własny model czy API: rachunek na rokPorównanie własnego modelu z modelem udostępnianym przez API to porównanie kosztu stałego ze zmiennym, a nie dwóch cen za to samo.
- Ile kosztuje agent AI dla firmy?Agent AI do jednego procesu kosztuje w Polsce według publicznych cenników z 2026 roku od 8 do 250 tys. zł netto wdrożenia plus…
- Ile kosztuje utrzymanie AI miesięcznie?Miesięczny koszt utrzymania rozwiązania AI dzieli się na pozycję rosnącą z użyciem, czyli opłaty za API modelu…
- Jak oznaczać treści wygenerowane przez AI zgodnie z art. 50Artykuł 50 AI Act rozdziela dwa obowiązki oznaczania, które w komentarzach zlewają się w jeden: dostawca systemu generującego…
Masz konkretny proces do omówienia?
Napisz, jaki to proces i ile razy w miesiącu się powtarza. Odpowiem, czy nadaje się do automatyzacji, również wtedy, gdy odpowiedź brzmi „nie warto”.
Albo prosto na adres: not-a-bot@