Przejdź do treści
Robert Marczyński

Claude Fable 5.1: ceny bazowe bez zmian, na tańszym cache zyskają głównie agenci

Anthropic wydał 1 września 2026 Claude Fable 5.1 i Mythos 5.1. Ceny bazowe API nie zmieniły się względem Fable 5 (10 USD za milion tokenów wejścia, 50 USD za wyjście), a jedyną zmianą cennikową jest odczyt z cache, tańszy o 75% (0,25 USD zamiast 1,00 USD za milion tokenów). Deklarowane przez producenta oszczędności, ok. 25% przy typowych obciążeniach i do ok. 45% przy agentowych, wynikają z tej obniżki i z mniejszego zużycia tokenów, dotyczą więc głównie długiego kontekstu czytanego wielokrotnie, a nie pojedynczych zapytań. Największe skoki w benchmarkach to Terminal-Bench-Science z 24,7% do 52,6% i AutomationBench z 17,1% do 31,4%, ale to liczby producenta z dnia premiery, bez niezależnych replikacji. Mythos 5.1 to ten sam model z innymi zabezpieczeniami, dostępny na razie wyłącznie dla zweryfikowanych organizacji z USA, więc polska firma pracuje na Fable. Wyjścia modeli wydanych po 2 sierpnia 2026 noszą niewidoczny znak wodny, który Anthropic wiąże z EU AI Act.

Robert Marczyński11 min czytania5 źródeł

Anthropic wydał 1 września 2026 Claude Fable 5.1 i Mythos 5.1, niecałe trzy miesiące po premierze Fable 5 z 9 czerwca. Dla firmy, która płaci za API, najważniejsze zdanie z tego ogłoszenia dotyczy cennika: stawki bazowe się nie zmieniły. Wejście kosztuje 10 USD za milion tokenów, wyjście 50 USD, dokładnie jak w Fable 5. Drgnęła jedna pozycja — odczyt z cache, z 1,00 USD do 0,25 USD za milion tokenów, czyli −75%. Z tej obniżki i z deklarowanego mniejszego zużycia tokenów Anthropic wyprowadza oszczędności ok. 25% przy typowych obciążeniach i do ok. 45% przy agentowych. Kto wysyła pojedyncze zapytania bez cache, zapłaci za token tyle samo co przed premierą.

Zastrzeżenie na początek, bo piszę dzień po ogłoszeniu: wszystkie liczby o jakości modelu w tym tekście pochodzą od Anthropic. Niezależnych replikacji jeszcze nie ma, sam też nie zdążyłem 5.1 przetestować. Ten tekst rozbiera ogłoszenie i cennik; testy przyjdą później. (Nawet dzień premiery wymaga przypisu: ogłoszenie Anthropic nosi tylko datę „September 2026”, a 1 września potwierdza relacja VentureBeat z tego dnia.)

Cennik: stawki bazowe stoją, taniej robi się w cache

Cennik Anthropic, stan z 2 września 2026, dopisuje do liczb z leadu kilka pozycji. Nowa stawka odczytu z cache to 2,5% ceny wejścia zamiast dotychczasowych 10%. Zapis do cache kosztuje tyle co wcześniej: 12,50 USD za milion przy cache pięciominutowym i 20 USD przy godzinnym. Batch API wycenia Fable 5.1 na 5 USD za wejście i 25 USD za wyjście. W API model działa pod identyfikatorem claude-fable-5⁠-⁠1; według dokumentacji modeli Anthropic z tego samego dnia okno kontekstu to bez zmian milion tokenów, a limit wyjścia — 128 tys. tokenów.

Mechanika oszczędności jest prosta. Agent wykonujący zadanie w pętli przy każdym kroku odsyła do modelu niemal ten sam, długi kontekst: te same instrukcje i całą dotychczasową historię rozmowy z przeczytanymi po drodze plikami. Przy dobrze ustawionym cache ogromna większość tych tokenów to właśnie odczyty z cache, więc gdy ta pozycja tanieje czterokrotnie, rachunek agenta spada, choć stawki bazowe stoją w miejscu.

Stąd moja rada, zanim ktokolwiek uwierzy w 25⁠–⁠45%: policz własny rozkład, i to w kwotach, nie w liczbie tokenów. Token wyjścia jest 200 razy droższy od tokenu odczytu z cache (50 USD wobec 0,25 USD za milion), więc nawet tam, gdzie odczyty cache dominują liczbowo, w kwocie rachunku ważą znacznie mniej. W rozliczeniu API widać osobno pozycje za wejście, wyjście, zapis do cache i odczyty z cache. Oszczędność z tej obniżki to 75% pomnożone przez udział odczytów cache w kwocie: przy połowie kwoty rozliczenia z całości zejdzie 37,5%, a pełne −75% dopiero wtedy, gdy odczyty robią niemal cały rachunek. Jeśli to kilka procent kwoty — jak w czacie, który zadaje jedno pytanie i dostaje jedną odpowiedź — po stronie cennika nie zmienia się dla Ciebie nic. Zostaje deklarowane mniejsze zużycie tokenów, o ile potwierdzi się w praktyce.

Benchmarki: liczby producenta, największe skoki w terminalu i automatyzacji

Wszystkie wartości poniżej pochodzą z ogłoszenia Anthropic z 1 września 2026.

Benchmark Co mierzy Fable 5 Fable 5.1
Terminal-Bench 4.0 pracę agenta z zadaniami w wierszu poleceń 42,0% 55,8%
Terminal-Bench-Science 0.1 zadania badawcze wykonywane w terminalu, np. analizę danych 24,7% 52,6%
AutomationBench automatyzację wieloetapowych zadań roboczych od początku do końca 17,1% 31,4%
GDPval-AA v2 porównawczą jakość wykonania zadań zawodowych o wartości ekonomicznej 1723 pkt Elo 1853 pkt Elo
OSWorld 2.0 (partial) obsługę komputera przez interfejs graficzny, z zaliczeniem częściowym 72,9% 77,9%
OSWorld 2.0 (strict) to samo przy wymogu pełnego wykonania zadania 36,1% 41,7%
Humanity’s Last Exam (bez narzędzi) trudne pytania eksperckie z wielu dziedzin 57,8% 60,9%
Humanity’s Last Exam (z narzędziami) te same pytania z dostępem do wyszukiwania i narzędzi 63,8% 65,0%
CursorBench 3.2.0 zadania programistyczne wykonywane przez agenta kodowania 70,5% 73,4%

Dwa skoki wybijają się ponad resztę. Terminal-Bench-Science urósł z 24,7% do 52,6%, czyli ponad dwukrotnie; AutomationBench z 17,1% do 31,4%. Oba startowały z niskiej bazy, więc o duży względny przyrost było tu łatwiej niż w nasyconych testach, i oba celują dokładnie w to, na czym Anthropic buduje narrację o agentach wykonujących pracę bez nadzoru. Tuż za nimi idzie Terminal-Bench 4.0: z 42,0% do 55,8%, czyli o 13,8 punktu procentowego, niemal tyle samo co 14,3 punktu w AutomationBench, tylko od wyższej podstawy.

Osobno stoi GDPval-AA v2, liczony w punktach Elo, nie w procentach. Wzrost o 130 punktów, z 1723 na 1853, to również jeden z większych deklarowanych skoków tej premiery (w standardowej interpretacji skali Elo odpowiadałby blisko 68% preferencji w porównaniach parami — to moje przybliżenie, ogłoszenie takiej skali nie deklaruje).

Reszta tabeli to przyrosty o kilka punktów procentowych. Porządne, ale niezmieniające obrazu modelu.

Zabezpieczenia rzadziej blokują nieszkodliwe pytania

Druga oś tej premiery to fałszywe blokady — i tu ważny niuans: to zmiana w zabezpieczeniach, nie w samym modelu. Anthropic wymienił przy premierze filtry i deklaruje, że nowe zabezpieczenia biologiczne, obejmujące zarówno Fable 5.1, jak i Fable 5, odzywają się o 85% rzadziej przy nieszkodliwych, prostych pytaniach biologicznych i medycznych, względem filtrów z czerwcowej premiery Fable 5. Użytkownicy Claude Code mają z kolei widzieć średnio ok. 60% mniej interwencji zabezpieczeń cybernetycznych na sesję, także względem poprzednich filtrów. Polityka użycia dopuściła też jawnie wykrywanie podatności w oprogramowaniu, bez tworzenia exploitów.

Ta akurat poprawa nie jest więc argumentem za migracją — dostaje ją również ten, kto zostaje na starym modelu. W codziennej pracy i tak jest to konkret. Zespół robiący analizy w biotechu albo audyt bezpieczeństwa rzadziej trafi na odmowę przy pytaniu, w którym nie ma niczego groźnego, a przerwana sesja agenta kosztuje realne pieniądze: przebieg trzeba powtórzyć i drugi raz zapłacić za tokeny.

Mythos 5.1 zostaje w USA, polska firma pracuje na Fable

Mythos 5.1 to według Anthropic ten sam model co Fable 5.1, z innymi poziomami zabezpieczeń. Dostęp prowadzi przez programy weryfikacyjne Cyber Verification Program i Life Sciences Verification Program, a na dzień premiery obejmuje wyłącznie organizacje z USA. Wniosek dla polskiego rynku mieści się w jednym zdaniu: kupujesz Fable 5.1 i na nim liczysz koszty.

Dla polskiej firmy z restrykcyjną umową o retencji danych ważniejsza od samego Mythosa może być druga zapowiedź z tej premiery: Enterprise Frontier Safeguards, czyli wykrywanie nadużyć bez oddawania danych monitoringu do Anthropic. Ogłoszenie mówi o programie powstałym we współpracy z AWS, Google Cloud i Microsoft Azure oraz o wdrożeniu etapami od jesieni 2026; szczegóły architektury opisuje relacja VentureBeat z 1 września. Dane monitoringu zostają we własnym środowisku klienta w jednej z tych chmur, pod kluczami szyfrującymi, politykami dostępu i dziennikami audytu, którymi zarządza klient; do czasu startu uprawnione firmy dostają 5.1 w trybie zero data retention. To na razie zapowiedź, ale z architekturą po stronie klienta i datą startu, którą da się wpisać do kalendarza.

Znak wodny w wyjściach obejmie każdego, kto publikuje treści z modelu

W relacjach z premiery ten wątek ginie za benchmarkami, a dla rynku UE jest najpraktyczniejszy: Anthropic ogłosił, że wyjścia modeli wydanych po 2 sierpnia 2026 noszą niewidoczny znak wodny, co firma wiąże z obowiązkami przejrzystości EU AI Act. Cezura powinna działać w obie strony — tak czytam komunikat, który mówi wyłącznie o modelach wydanych po tej dacie: wyjścia wcześniejszych, w tym Fable 5, na którym wiele firm pracuje dziś, znaku nosić nie powinny. Jeśli ten wniosek się utrzyma, migracja na 5.1 to także decyzja o wykrywalności publikowanych treści, obok kosztu i jakości. Uzupełnieniem jest Detection API, na razie dla uprawnionych organizacji — m.in. regulatorów, organów ścigania, mediów, fact-checkerów i niezależnych badaczy; osobną ścieżkę mają firmy, a Anthropic zapowiada stopniowe poszerzanie dostępu do tego API.

Treść wygenerowana przez Fable 5.1 staje się więc, przynajmniej dla tego grona, technicznie rozpoznawalna. Firma, która publikuje teksty z modeli i zakłada, że nikt tego nie sprawdzi, właśnie dostała powód, by przemyśleć, jak oznaczać treści AI, zanim zainteresuje się tym ktoś z listy uprawnionych. O odporności samego znaku na parafrazę czy tłumaczenie ogłoszenie nie mówi nic, więc wstrzymuję się z wnioskami w którąkolwiek stronę.

Komu ta aktualizacja zmienia rachunek od razu

Aktualizacja od razu ma znaczenie tam, gdzie pracują agenci na długim kontekście, i wszędzie, gdzie przez API idzie duży wolumen — także przez Batch API. W takich obciążeniach podmiana identyfikatora modelu na claude-fable-5⁠-⁠1 i tydzień obserwacji rozliczenia dadzą odpowiedź lepszą niż każdy tekst z dnia premiery, mój włącznie. Co poza modelem składa się na koszt agenta, policzyłem w osobnej odpowiedzi, a rachunek utrzymania AI rozpisałem oddzielnie. Sam wybór nie jest przy tym zero-jedynkowy w czasie: według ogłoszenia 5.1 jest od premiery dostępny na wszystkich platformach, w tym w Amazon Web Services, Google Cloud i Microsoft Azure, a Fable 5 figuruje w dokumentacji Anthropic jako model nadal dostępny (stan z 2 września 2026) — pozostanie przy nim to opcja, nie przymus.

Przy pojedynczych zapytaniach bez cache cenowo nie zmienia się nic, a jakościowo tyle, ile pokażą niezależne testy. W takiej sytuacji nie widzę powodu do migracji w dniu premiery; odczekanie dwóch tygodni na cudze pomiary bywa tańsze niż własny pilotaż na gorąco.

Na koniec rzecz szersza niż jedna premiera: rachunek „własny model czy API” po tym ogłoszeniu przechyla się odrobinę w stronę API, bo deklarowana jakość rośnie przy niższym koszcie odczytu. Wrócę do tematu, gdy będę miał własne pomiary; do tego czasu traktuję 25⁠–⁠45% jak każdą obietnicę z dnia premiery, czyli jak hipotezę do sprawdzenia na własnym rozliczeniu.

Najczęstsze pytania

Ile kosztuje Claude Fable 5.1 w API?
Według cennika Anthropic (odczyt z 2 września 2026, dzień po premierze) stawki bazowe są takie same jak w Fable 5: 10 USD za milion tokenów wejścia i 50 USD za milion tokenów wyjścia. Zmienił się tylko odczyt z cache: 0,25 USD za milion tokenów zamiast 1,00 USD, czyli o 75% mniej. Zapis do cache kosztuje bez zmian 12,50 USD za milion przy cache pięciominutowym i 20 USD przy godzinnym, a Batch API 5 USD za wejście i 25 USD za wyjście.
Skąd się biorą oszczędności 25⁠–⁠45%, skoro ceny bazowe się nie zmieniły?
Z dwóch źródeł, oba według deklaracji Anthropic z 1 września 2026: odczyt z cache staniał o 75% (z 1,00 USD do 0,25 USD za milion tokenów), a model ma zużywać mniej tokenów na te same zadania. Ok. 25% dotyczy typowych obciążeń, do ok. 45% agentowych, bo agent przy każdym kroku czyta ten sam długi kontekst i odczyty cache robią większość wolumenu jego tokenów — ile z tego widać w kwocie rachunku, zależy od udziału droższych tokenów wyjścia. Przy pojedynczym zapytaniu bez cache stawki za token są dokładnie te same co w Fable 5, a rachunek zmieni się najwyżej o tyle, o ile model faktycznie zużyje mniej tokenów.
Czy wyniki benchmarków Claude Fable 5.1 są niezależnie potwierdzone?
Nie. Wszystkie porównania z Fable 5 pochodzą z materiałów Anthropic z 1 września 2026, a do 2 września 2026 nie znalazłem niezależnych replikacji, co przy premierze sprzed jednego dnia jest normalne. Największe deklarowane skoki to Terminal-Bench-Science z 24,7% do 52,6% i AutomationBench z 17,1% do 31,4%; mniejsze przyrosty dotyczą m.in. OSWorld 2.0 (77,9% wobec 72,9% w wariancie partial) i Humanity’s Last Exam (60,9% wobec 57,8% bez narzędzi).
Czym Mythos 5.1 różni się od Fable 5.1 i czy kupię go w Polsce?
Według Anthropic to ten sam model z innymi poziomami zabezpieczeń, dostępny przez programy weryfikacyjne Cyber Verification Program i Life Sciences Verification Program, na dzień premiery (1 września 2026) wyłącznie dla organizacji z USA. Polska firma pracuje więc na Fable 5.1; w API model nazywa się claude-fable-5⁠-⁠1.
Czy treści z Claude Fable 5.1 mają znak wodny?
Tak. Anthropic ogłosił 1 września 2026, że wyjścia modeli wydanych po 2 sierpnia 2026 noszą niewidoczny znak wodny, co firma wiąże z obowiązkami przejrzystości EU AI Act. Do tego dochodzi Detection API, na razie dla uprawnionych organizacji, m.in. regulatorów, organów ścigania, mediów, fact-checkerów i niezależnych badaczy; osobny dostęp mają firmy. Zwykły czytelnik znaku nie zobaczy, ale wykrywalność treści z modelu przestaje być czysto teoretyczna.
Co zmieniają rzadsze fałszywe blokady przy premierze Fable 5.1?
Anthropic wymienił przy premierze 1 września 2026 zabezpieczenia i deklaruje, że nowe filtry biologiczne, obejmujące zarówno Fable 5.1, jak i Fable 5, odzywają się o 85% rzadziej przy nieszkodliwych, prostych pytaniach biologicznych i medycznych (względem filtrów z premiery Fable 5), a użytkownicy Claude Code mają widzieć średnio ok. 60% mniej interwencji zabezpieczeń cybernetycznych na sesję. Do polityki użycia doszło jawnie dozwolone wykrywanie podatności w oprogramowaniu, bez tworzenia exploitów. Obie liczby pochodzą od producenta; poprawa filtrów biologicznych objęła także Fable 5, więc akurat ona nie wymaga migracji.

Źródła

Dane zewnętrzne przywołane w tekście mają tu swoje źródła.

  1. Anthropic — ogłoszenie Claude Fable 5.1 i Mythos 5.1: cennik, benchmarki, deklarowane oszczędności 25⁠–⁠45%, znak wodny i programy weryfikacyjne (wrzesień 2026) (nowa karta)
  2. Anthropic — cennik API: stawki Fable 5.1, odczyt cache 0,25 USD/mln, zapis do cache, Batch API (odczyt z 2.09.2026) (nowa karta)
  3. Anthropic — przegląd modeli: okno kontekstu 1 mln tokenów i limit wyjścia 128 tys. dla Fable 5.1 (odczyt z 2.09.2026) (nowa karta)
  4. Anthropic — ogłoszenie Claude Fable 5 i Mythos 5: ceny bazowe 10/50 USD za mln tokenów (9.06.2026) (nowa karta)
  5. VentureBeat — relacja z premiery Fable 5.1: obniżka odczytu cache o 75%, Enterprise Frontier Safeguards w AWS, Azure i Google Cloud; potwierdza dzień premiery (1.09.2026) (nowa karta)

Udostępnij

Powiązane

Masz konkretny proces do omówienia?

Napisz, jaki to proces i ile razy w miesiącu się powtarza. Odpowiem, czy nadaje się do automatyzacji, również wtedy, gdy odpowiedź brzmi „nie warto”.

Albo prosto na adres: not-a-bot@ekspertodsztucznejinteligencji.pl