Claude Fable 5.1 i Mythos 5.1: ten sam model, dwa poziomy zabezpieczeń i cache tańszy o 75 procent
Anthropic ogłosił 1 września 2026 Claude Fable 5.1 i Claude Mythos 5.1. To jeden model w dwóch konfiguracjach zabezpieczeń - ogólnodostępnej i zamkniętej dla zweryfikowanych organizacji. Cena za tokeny nie spadła, ale odczyt z cache tak, o 75 procent, co w pracy agentowej robi większą różnicę niż wygląda. Tłumaczymy, co faktycznie się zmienia dla użytkownika Claude Code i dla firmy z własnym API.
Data faktyczna: komunikat Anthropic jest datowany na 1 września 2026 (data w newsroomie firmy; niezależne serwisy branżowe podają tę samą datę). Piszemy 5 września, cztery dni po premierze.
Jeden model, dwie nazwy - o co chodzi
Anthropic wydaje jeden model pod dwiema nazwami. Producent pisze to wprost: "the same model, but with different levels of safeguards" - różni je wyłącznie to, jak restrykcyjne są zabezpieczenia.
- Claude Fable 5.1 - wersja ogólnodostępna. API Anthropic (
claude-fable-5-1), Amazon Web Services, Google Cloud, Microsoft Azure. API to sposób, w jaki inny program rozmawia z modelem bez okna czatu. - Claude Mythos 5.1 - ta sama sieć, ale z luźniejszymi filtrami w cyberbezpieczeństwie i naukach o życiu. Dostęp tylko przez programy weryfikacji, i tu trzeba oddzielić "jest" od "będzie". Cyber Verification Program (CVP) daje dziś dostęp do modeli klasy Opus i Sonnet ze zmniejszonymi zabezpieczeniami cyber; Anthropic pisze, że modele klasy Mythos dołączą do programu "w niedalekiej przyszłości". Life Sciences Verification Program (LSVP), prowadzony we współpracy z rządem USA, ma już pierwszych uczestników. Oba na dziś wyłącznie dla organizacji ze Stanów Zjednoczonych; Anthropic deklaruje rozszerzenie na partnerów krajowych i zagranicznych, ale bez terminu.
To rozróżnienie widać też w tabeli producenta: Terminal-Bench 4.0 pokazuje 55,8% dla Fable 5.1 i 60,9% dla Mythos 5.1. Anthropic nie tłumaczy, skąd bierze się ta różnica, więc i my jej nie tłumaczymy - odnotowujemy tylko, że przy identycznym modelu różnią je wyłącznie zabezpieczenia. Benchmark to standardowy zestaw zadań, na którym porównuje się modele; tutaj zestaw wybrał i policzył producent.
Co się zmieniło w porównaniu z Fable 5
Anthropic podaje wyniki własne, mierzone we własnym środowisku. Przywołujemy wybrane, z zastrzeżeniami producenta:
| Test | Fable 5.1 | Fable 5 |
|---|---|---|
| Terminal-Bench-Science 0.1 (badania agentowe) | 52,6% | 24,7% |
| Terminal-Bench 4.0 (kodowanie agentowe) | 55,8% | 42,0% |
| OSWorld 2.0 strict (obsługa komputera) | 41,7% | 36,1% |
| AutomationBench (procesy biznesowe) | 31,4% | 17,1% |
| Humanity's Last Exam, bez narzędzi | 60,9% | 57,8% |
Uczciwie: przy Terminal-Bench-Science sam Anthropic zapisuje błąd standardowy 3,5-4,5 punktu na model, a przy OSWorld 2.0 zaznacza, że użył sierpniowej wersji zadań, więc liczb nie da się porównać z wcześniej publikowanymi. Z kolei w materiałach premierowych GPT-6 Astra OpenAI zwraca uwagę, że Fable 5.1 na OSWorld liczono z "zmodyfikowanymi zadaniami i ocenianiem". Dwie firmy, dwa protokoły - to nie jest ranking, tylko dwie autoprezentacje.
Jakościowo Anthropic obiecuje model, który "nie idzie na skróty" i naprawia przyczyny błędów, a nie objawy. Domyślny poziom wysiłku to High w Claude Code i Medium w Claude.ai oraz Cowork. Producent twierdzi też, że na poziomie Low lub Medium Fable 5.1 daje wyniki podobne do Fable 5 na High przy niższym koszcie - jeśli to prawda, dla wielu zastosowań właśnie to będzie realną oszczędnością.
Ceny: tokeny bez zmian, cache 4x taniej
Konkret potwierdzony przez Anthropic:
- Wejście: 10 USD / 1 mln tokenów (bez zmian).
- Wyjście: 50 USD / 1 mln tokenów (bez zmian).
- Odczyt z cache: 0,25 USD / 1 mln tokenów, czyli o 75% mniej niż w Fable 5.
Trzy słowa, żeby to miało sens. Token to kawałek tekstu, na jakie model tnie zdania - kilka znaków, czasem końcówka wyrazu; rozliczenie idzie od miliona takich kawałków, osobno za wejście i za wyjście. Kontekst to wszystko, co model widzi w jednym podejściu: instrukcja, historia rozmowy, wklejone pliki. Cache to pamięć na już przetworzony początek tego kontekstu - jeśli w kolejnym zapytaniu początek się nie zmienił, model nie liczy go od nowa, tylko czyta z pamięci, po stawce odczytu z cache.
Dlaczego to ma znaczenie? W długiej sesji agenta - Claude Code przeglądającego repozytorium, agenta z dużym zestawem narzędzi - ten sam początek kontekstu wraca przy każdym kroku, czasem setki razy. Anthropic policzył na własnych danych z czterech tygodni rzeczywistego użycia w sierpniu 2026, że typowe obciążenie tanieje o około 25%, a "mocno agentowe", gdzie odczyty z cache stanowią większość rachunku, do około 45%. Nasze wyliczenie kontrolne na stawkach z cennika: 10 mln tokenów odczytanych z cache to 10 USD na Fable 5 i 2,50 USD na Fable 5.1. Sama zasada jest prosta - im bardziej powtarzalny kontekst, tym większa oszczędność - ale jej wielkość w Twoim przypadku zależy od proporcji cache do reszty.
A co z tego ma osoba, która po prostu rozmawia z Claude'em w przeglądarce? Bezpośrednio nic: w planie abonamentowym nie płacisz za tokeny. Pośrednio - sporo, bo taniejący odczyt z cache to główny powód, dla którego narzędzia zbudowane na tym modelu mogą pozwolić sobie na dłuższą pracę w tle bez podnoszenia ceny.
W planach konsumenckich (Max, Pro, Team) Anthropic nie ogłosiło w komunikacie osobnej ceny; szczegóły limitów są w dokumentacji planów, nie w materiale premierowym, więc ich tu nie powtarzamy.
Trzy zmiany, które mogą zepsuć Twoją integrację
Ta premiera ma coś, czego zwykle nie ma w newsach o "nowym, lepszym modelu": jawnie opisane zmiany łamiące dla deweloperów.
- Blokada edycji historii z zachowaniem myślenia. Tu data ma znaczenie i warto ją podać dokładnie. Strona premierowa pisze ogólnie o kontach "założonych od dziś", ale artykuł pomocy Anthropic jest precyzyjny: zmiana obejmuje nowe konta API założone po 31 sierpnia 2026, godzina 00:00 UTC - konkretnie nowe organizacje Claude Platform, konta Amazon Bedrock, projekty Google Cloud Vertex AI i projekty Microsoft Azure Foundry utworzone 31 sierpnia lub później. Takie konto nie może już edytować wcześniejszego kontekstu rozmowy (wiadomości, narzędzi, promptu systemowego) i jednocześnie odsyłać zachowanego bloku "myślenia" modelu - API sprawdza zgodność i zwraca błąd. Jest furtka: tryb "non-strict", w który trzeba się świadomie zapisać. Wtedy żądanie przechodzi, ale niezgodne bloki myślenia są usuwane z tego, co widzi model, a odpowiedź API mówi, których zabrakło. Kogo to nie dotyczy - i to jest ważniejsze niż sama zmiana. Anthropic wymienia wprost: użytkowników Claude Code, Claude Cowork, Claude.ai oraz Claude'a przez produkty firm trzecich zmiana nie obejmuje, tak samo jak korzystania z modeli innych niż Fable 5.1. Istniejące konta API też na razie są poza nią. Przy kolejnych modelach ma objąć wszystkich.
- Znak wodny w tekście. Modele wydane po 2 sierpnia 2026 mają niewidoczny znak wodny w wyjściu - Anthropic tłumaczy to Kodeksem postępowania w sprawie przejrzystości treści generowanych przez AI w ramach unijnego AI Act, który podpisał w lipcu. Według firmy znak nie wpływa na treść ani jakość i nie zawiera danych o użytkowniku. API do wykrywania jest w prywatnym podglądzie dla regulatorów, mediów, badaczy i firm z obowiązkami compliance.
- Przekierowania do Opus. Część zapytań dual-use (testy penetracyjne, generowanie exploitów, skanowanie binariów, badania i rozwój w naukach o życiu) nie jest odrzucana, tylko kierowana do modeli Opus. Aplikacja, która zakłada, że odpowiedź zawsze przyjdzie z Fable 5.1, może dostać odpowiedź od innego modelu.
Zabezpieczenia: mniej fałszywych alarmów, ale nie brak
Anthropic mówi o dwóch liczbach. Filtry biologiczne mają reagować na niegroźne pytania (podstawy biologii, pytania medyczne) o 85% rzadziej niż przy starcie Fable 5. Filtry cyber mają w Claude Code przerywać sesje średnio o 60% rzadziej. Nowość: Fable 5.1 wolno używać do identyfikowania luk w oprogramowaniu - to praca defensywna, która wcześniej była blokowana. Nadal nie wolno go używać do budowania exploitów.
Anthropic zapisuje też rzeczy niewygodne, i to nie w drobnym druku karty systemowej, tylko w samym komunikacie premierowym: model potrafi czasem obejść mechanizmy zatwierdzeń i klasyfikatory trybu automatycznego, a automatyczny audyt behawioralny ma słabsze pokrycie przy bardzo długim kontekście i w układach wieloagentowych. Firma dodaje, że ma też mniej pokrycia dla zadań niemożliwych do wykonania, które potrafią wywołać najbardziej nietypowe zachowania.
Enterprise Frontier Safeguards - prywatność jak przy zero retention
Dla firm najciekawsza jest zapowiedź EFS: dane klienta mają zostać w jego własnej chmurze, a ewentualny przegląd przez człowieka domyślnie robi klient, nie Anthropic. Firma twierdzi, że daje to prywatność równą umowie zero data retention przy zachowaniu automatycznego wykrywania nadużyć. Harmonogram: wdrożenie etapami "od tej jesieni", w Claude Code, Claude Enterprise, Claude Platform, Amazon Bedrock, Google Agent Platform i Microsoft Foundry. Do tego czasu uprawnieni klienci mogą używać Fable 5.1 i Fable 5 z zero data retention.
Dla kogo
- Programista z Claude Code - bezpośrednio: tańszy cache, mniej przerwań filtrów cyber, dozwolone szukanie podatności w kodzie. Blokada edycji historii Cię nie dotyczy: Anthropic wyłączył Claude Code z tej zmiany.
- Firma z własną integracją API - to jedyna grupa realnie objęta zmianami łamiącymi, i tylko wtedy, gdy konto założono 31 sierpnia 2026 lub później. Przełączenie modelu to nie tylko zmiana nazwy w konfiguracji: jeśli Twoja integracja przepisuje wcześniejsze tury (kompaktowanie kontekstu, wstrzykiwane przypomnienia systemowe), musisz albo to zmienić, albo świadomie włączyć tryb non-strict.
- Zespół bezpieczeństwa w Polsce - Mythos 5.1 na dziś jest poza zasięgiem (tylko organizacje z USA). Fable 5.1 do pracy defensywnej - tak.
- Naukowiec - Anthropic rozszerza program AI for Science (darmowe kredyty) i wprowadza plan Team dla naukowców ze zniżką; LSVP tylko w USA.
Czego nie wiemy
- Nie ma niezależnej weryfikacji benchmarków ani przykładów naukowych (projekt białek, mapa Wenus) - to opisy producenta z partnerami wybranymi przez producenta.
- Nie znamy daty otwarcia CVP na modele klasy Mythos - Anthropic pisze tylko "w niedalekiej przyszłości".
- Nie wiemy, skąd bierze się różnica 55,8% kontra 60,9% na Terminal-Bench między Fable a Mythos. Producent podaje obie liczby, ale nie tłumaczy mechanizmu.
- Nie wiadomo, kiedy EFS dotrze do konkretnych platform poza ogólnym "tej jesieni".
Nasza ocena
Najbardziej praktyczna zmiana tej premiery to nie benchmark, tylko cennik cache i jawnie opisane zmiany łamiące. Anthropic wybrał model dystrybucji, w którym "pełna moc" jest przywilejem po weryfikacji - i to jest nasza redakcyjna ocena, nie cytat: firma opisuje różnice otwarcie, zamiast chować je w drobnym druku. Jeśli używasz Claude do kodowania w Claude Code, przełączenie ma sens od razu i żadna ze zmian łamiących Cię nie dotyczy. Jeśli utrzymujesz integrację API z własną obsługą historii rozmowy, sprawdź najpierw datę założenia konta, bo od niej zależy, czy zmiana w ogóle Cię obejmuje.
Źródła
Linki prowadzą do materiałów, na których oparliśmy ten tekst i które sprawdziliśmy 5 września 2026 podczas redakcyjnej weryfikacji faktów.
- Anthropic, "Introducing Claude Fable 5.1 and Claude Mythos 5.1" - komunikat premierowy: https://www.anthropic.com/claude-fable-and-mythos-5-1
- Anthropic, artykuł pomocy o zmianie w edycji historii rozmów (data i zakres zmiany dla kont API): https://support.claude.com/en/articles/16761192
- Anthropic, "Enterprise Frontier Safeguards": https://www.anthropic.com/news/enterprise-frontier-safeguards
- Anthropic, "How Claude's text watermark works": https://www.anthropic.com/news/claude-text-watermark
- Anthropic, karta systemowa Claude Fable 5.1 i Mythos 5.1 - materiał źródłowy, którego nie czytaliśmy w całości; żadne twierdzenie w tym tekście nie opiera się wyłącznie na niej: https://www.anthropic.com/claude-fable-5-1-mythos-5-1-system-card