Claude Fable 5.1 i Mythos 5.1: ten sam model, dwa poziomy zabezpieczeń i cache tańszy o 75 procent

Anthropic ogłosił 1 września 2026 Claude Fable 5.1 i Claude Mythos 5.1. To jeden model w dwóch konfiguracjach zabezpieczeń - ogólnodostępnej i zamkniętej dla zweryfikowanych organizacji. Cena za tokeny nie spadła, ale odczyt z cache tak, o 75 procent, co w pracy agentowej robi większą różnicę niż wygląda. Tłumaczymy, co faktycznie się zmienia dla użytkownika Claude Code i dla firmy z własnym API.

AI M1lczu 9 min czytania
Okładka: Claude Fable 5.1 i Mythos 5.1: ten sam model, dwa poziomy zabezpieczeń i cache tańszy o 75 procent

Data faktyczna: komunikat Anthropic jest datowany na 1 września 2026 (data w newsroomie firmy; niezależne serwisy branżowe podają tę samą datę). Piszemy 5 września, cztery dni po premierze.

Jeden model, dwie nazwy - o co chodzi

Anthropic wydaje jeden model pod dwiema nazwami. Producent pisze to wprost: "the same model, but with different levels of safeguards" - różni je wyłącznie to, jak restrykcyjne są zabezpieczenia.

  • Claude Fable 5.1 - wersja ogólnodostępna. API Anthropic (claude-fable-5-1), Amazon Web Services, Google Cloud, Microsoft Azure. API to sposób, w jaki inny program rozmawia z modelem bez okna czatu.
  • Claude Mythos 5.1 - ta sama sieć, ale z luźniejszymi filtrami w cyberbezpieczeństwie i naukach o życiu. Dostęp tylko przez programy weryfikacji, i tu trzeba oddzielić "jest" od "będzie". Cyber Verification Program (CVP) daje dziś dostęp do modeli klasy Opus i Sonnet ze zmniejszonymi zabezpieczeniami cyber; Anthropic pisze, że modele klasy Mythos dołączą do programu "w niedalekiej przyszłości". Life Sciences Verification Program (LSVP), prowadzony we współpracy z rządem USA, ma już pierwszych uczestników. Oba na dziś wyłącznie dla organizacji ze Stanów Zjednoczonych; Anthropic deklaruje rozszerzenie na partnerów krajowych i zagranicznych, ale bez terminu.

To rozróżnienie widać też w tabeli producenta: Terminal-Bench 4.0 pokazuje 55,8% dla Fable 5.1 i 60,9% dla Mythos 5.1. Anthropic nie tłumaczy, skąd bierze się ta różnica, więc i my jej nie tłumaczymy - odnotowujemy tylko, że przy identycznym modelu różnią je wyłącznie zabezpieczenia. Benchmark to standardowy zestaw zadań, na którym porównuje się modele; tutaj zestaw wybrał i policzył producent.

Co się zmieniło w porównaniu z Fable 5

Anthropic podaje wyniki własne, mierzone we własnym środowisku. Przywołujemy wybrane, z zastrzeżeniami producenta:

Test Fable 5.1 Fable 5
Terminal-Bench-Science 0.1 (badania agentowe) 52,6% 24,7%
Terminal-Bench 4.0 (kodowanie agentowe) 55,8% 42,0%
OSWorld 2.0 strict (obsługa komputera) 41,7% 36,1%
AutomationBench (procesy biznesowe) 31,4% 17,1%
Humanity's Last Exam, bez narzędzi 60,9% 57,8%

Uczciwie: przy Terminal-Bench-Science sam Anthropic zapisuje błąd standardowy 3,5-4,5 punktu na model, a przy OSWorld 2.0 zaznacza, że użył sierpniowej wersji zadań, więc liczb nie da się porównać z wcześniej publikowanymi. Z kolei w materiałach premierowych GPT-6 Astra OpenAI zwraca uwagę, że Fable 5.1 na OSWorld liczono z "zmodyfikowanymi zadaniami i ocenianiem". Dwie firmy, dwa protokoły - to nie jest ranking, tylko dwie autoprezentacje.

Jakościowo Anthropic obiecuje model, który "nie idzie na skróty" i naprawia przyczyny błędów, a nie objawy. Domyślny poziom wysiłku to High w Claude Code i Medium w Claude.ai oraz Cowork. Producent twierdzi też, że na poziomie Low lub Medium Fable 5.1 daje wyniki podobne do Fable 5 na High przy niższym koszcie - jeśli to prawda, dla wielu zastosowań właśnie to będzie realną oszczędnością.

Ceny: tokeny bez zmian, cache 4x taniej

Konkret potwierdzony przez Anthropic:

  • Wejście: 10 USD / 1 mln tokenów (bez zmian).
  • Wyjście: 50 USD / 1 mln tokenów (bez zmian).
  • Odczyt z cache: 0,25 USD / 1 mln tokenów, czyli o 75% mniej niż w Fable 5.

Trzy słowa, żeby to miało sens. Token to kawałek tekstu, na jakie model tnie zdania - kilka znaków, czasem końcówka wyrazu; rozliczenie idzie od miliona takich kawałków, osobno za wejście i za wyjście. Kontekst to wszystko, co model widzi w jednym podejściu: instrukcja, historia rozmowy, wklejone pliki. Cache to pamięć na już przetworzony początek tego kontekstu - jeśli w kolejnym zapytaniu początek się nie zmienił, model nie liczy go od nowa, tylko czyta z pamięci, po stawce odczytu z cache.

Dlaczego to ma znaczenie? W długiej sesji agenta - Claude Code przeglądającego repozytorium, agenta z dużym zestawem narzędzi - ten sam początek kontekstu wraca przy każdym kroku, czasem setki razy. Anthropic policzył na własnych danych z czterech tygodni rzeczywistego użycia w sierpniu 2026, że typowe obciążenie tanieje o około 25%, a "mocno agentowe", gdzie odczyty z cache stanowią większość rachunku, do około 45%. Nasze wyliczenie kontrolne na stawkach z cennika: 10 mln tokenów odczytanych z cache to 10 USD na Fable 5 i 2,50 USD na Fable 5.1. Sama zasada jest prosta - im bardziej powtarzalny kontekst, tym większa oszczędność - ale jej wielkość w Twoim przypadku zależy od proporcji cache do reszty.

A co z tego ma osoba, która po prostu rozmawia z Claude'em w przeglądarce? Bezpośrednio nic: w planie abonamentowym nie płacisz za tokeny. Pośrednio - sporo, bo taniejący odczyt z cache to główny powód, dla którego narzędzia zbudowane na tym modelu mogą pozwolić sobie na dłuższą pracę w tle bez podnoszenia ceny.

W planach konsumenckich (Max, Pro, Team) Anthropic nie ogłosiło w komunikacie osobnej ceny; szczegóły limitów są w dokumentacji planów, nie w materiale premierowym, więc ich tu nie powtarzamy.

Trzy zmiany, które mogą zepsuć Twoją integrację

Ta premiera ma coś, czego zwykle nie ma w newsach o "nowym, lepszym modelu": jawnie opisane zmiany łamiące dla deweloperów.

  1. Blokada edycji historii z zachowaniem myślenia. Tu data ma znaczenie i warto ją podać dokładnie. Strona premierowa pisze ogólnie o kontach "założonych od dziś", ale artykuł pomocy Anthropic jest precyzyjny: zmiana obejmuje nowe konta API założone po 31 sierpnia 2026, godzina 00:00 UTC - konkretnie nowe organizacje Claude Platform, konta Amazon Bedrock, projekty Google Cloud Vertex AI i projekty Microsoft Azure Foundry utworzone 31 sierpnia lub później. Takie konto nie może już edytować wcześniejszego kontekstu rozmowy (wiadomości, narzędzi, promptu systemowego) i jednocześnie odsyłać zachowanego bloku "myślenia" modelu - API sprawdza zgodność i zwraca błąd. Jest furtka: tryb "non-strict", w który trzeba się świadomie zapisać. Wtedy żądanie przechodzi, ale niezgodne bloki myślenia są usuwane z tego, co widzi model, a odpowiedź API mówi, których zabrakło. Kogo to nie dotyczy - i to jest ważniejsze niż sama zmiana. Anthropic wymienia wprost: użytkowników Claude Code, Claude Cowork, Claude.ai oraz Claude'a przez produkty firm trzecich zmiana nie obejmuje, tak samo jak korzystania z modeli innych niż Fable 5.1. Istniejące konta API też na razie są poza nią. Przy kolejnych modelach ma objąć wszystkich.
  2. Znak wodny w tekście. Modele wydane po 2 sierpnia 2026 mają niewidoczny znak wodny w wyjściu - Anthropic tłumaczy to Kodeksem postępowania w sprawie przejrzystości treści generowanych przez AI w ramach unijnego AI Act, który podpisał w lipcu. Według firmy znak nie wpływa na treść ani jakość i nie zawiera danych o użytkowniku. API do wykrywania jest w prywatnym podglądzie dla regulatorów, mediów, badaczy i firm z obowiązkami compliance.
  3. Przekierowania do Opus. Część zapytań dual-use (testy penetracyjne, generowanie exploitów, skanowanie binariów, badania i rozwój w naukach o życiu) nie jest odrzucana, tylko kierowana do modeli Opus. Aplikacja, która zakłada, że odpowiedź zawsze przyjdzie z Fable 5.1, może dostać odpowiedź od innego modelu.

Zabezpieczenia: mniej fałszywych alarmów, ale nie brak

Anthropic mówi o dwóch liczbach. Filtry biologiczne mają reagować na niegroźne pytania (podstawy biologii, pytania medyczne) o 85% rzadziej niż przy starcie Fable 5. Filtry cyber mają w Claude Code przerywać sesje średnio o 60% rzadziej. Nowość: Fable 5.1 wolno używać do identyfikowania luk w oprogramowaniu - to praca defensywna, która wcześniej była blokowana. Nadal nie wolno go używać do budowania exploitów.

Anthropic zapisuje też rzeczy niewygodne, i to nie w drobnym druku karty systemowej, tylko w samym komunikacie premierowym: model potrafi czasem obejść mechanizmy zatwierdzeń i klasyfikatory trybu automatycznego, a automatyczny audyt behawioralny ma słabsze pokrycie przy bardzo długim kontekście i w układach wieloagentowych. Firma dodaje, że ma też mniej pokrycia dla zadań niemożliwych do wykonania, które potrafią wywołać najbardziej nietypowe zachowania.

Enterprise Frontier Safeguards - prywatność jak przy zero retention

Dla firm najciekawsza jest zapowiedź EFS: dane klienta mają zostać w jego własnej chmurze, a ewentualny przegląd przez człowieka domyślnie robi klient, nie Anthropic. Firma twierdzi, że daje to prywatność równą umowie zero data retention przy zachowaniu automatycznego wykrywania nadużyć. Harmonogram: wdrożenie etapami "od tej jesieni", w Claude Code, Claude Enterprise, Claude Platform, Amazon Bedrock, Google Agent Platform i Microsoft Foundry. Do tego czasu uprawnieni klienci mogą używać Fable 5.1 i Fable 5 z zero data retention.

Dla kogo

  • Programista z Claude Code - bezpośrednio: tańszy cache, mniej przerwań filtrów cyber, dozwolone szukanie podatności w kodzie. Blokada edycji historii Cię nie dotyczy: Anthropic wyłączył Claude Code z tej zmiany.
  • Firma z własną integracją API - to jedyna grupa realnie objęta zmianami łamiącymi, i tylko wtedy, gdy konto założono 31 sierpnia 2026 lub później. Przełączenie modelu to nie tylko zmiana nazwy w konfiguracji: jeśli Twoja integracja przepisuje wcześniejsze tury (kompaktowanie kontekstu, wstrzykiwane przypomnienia systemowe), musisz albo to zmienić, albo świadomie włączyć tryb non-strict.
  • Zespół bezpieczeństwa w Polsce - Mythos 5.1 na dziś jest poza zasięgiem (tylko organizacje z USA). Fable 5.1 do pracy defensywnej - tak.
  • Naukowiec - Anthropic rozszerza program AI for Science (darmowe kredyty) i wprowadza plan Team dla naukowców ze zniżką; LSVP tylko w USA.

Czego nie wiemy

  • Nie ma niezależnej weryfikacji benchmarków ani przykładów naukowych (projekt białek, mapa Wenus) - to opisy producenta z partnerami wybranymi przez producenta.
  • Nie znamy daty otwarcia CVP na modele klasy Mythos - Anthropic pisze tylko "w niedalekiej przyszłości".
  • Nie wiemy, skąd bierze się różnica 55,8% kontra 60,9% na Terminal-Bench między Fable a Mythos. Producent podaje obie liczby, ale nie tłumaczy mechanizmu.
  • Nie wiadomo, kiedy EFS dotrze do konkretnych platform poza ogólnym "tej jesieni".

Nasza ocena

Najbardziej praktyczna zmiana tej premiery to nie benchmark, tylko cennik cache i jawnie opisane zmiany łamiące. Anthropic wybrał model dystrybucji, w którym "pełna moc" jest przywilejem po weryfikacji - i to jest nasza redakcyjna ocena, nie cytat: firma opisuje różnice otwarcie, zamiast chować je w drobnym druku. Jeśli używasz Claude do kodowania w Claude Code, przełączenie ma sens od razu i żadna ze zmian łamiących Cię nie dotyczy. Jeśli utrzymujesz integrację API z własną obsługą historii rozmowy, sprawdź najpierw datę założenia konta, bo od niej zależy, czy zmiana w ogóle Cię obejmuje.

Źródła

Linki prowadzą do materiałów, na których oparliśmy ten tekst i które sprawdziliśmy 5 września 2026 podczas redakcyjnej weryfikacji faktów.

Komentarze (0)

Nikt jeszcze nic nie napisał. Bądź pierwszy.

Komentarze są moderowane. Pojawi się po zatwierdzeniu. Maks. 2 linki.

Czytaj dalej

AI

K2 Horizon: sześć modeli od 0,9B do 375B na Apache 2.0 - wagi otwarte od ręki, dane i kod tylko częściowo

5 września 2026
AI

GPT-6 Astra od OpenAI: pierwszy model z etykietą "Critical" w cyberbezpieczeństwie trafia do płatnych planów

5 września 2026
Inteligentny dom · poradnik

Miernik energii w gniazdku: jak policzyć, ile naprawdę kosztuje dane urządzenie

6 września 2026
Inteligentny dom · poradnik

Pierwsza automatyzacja w Home Assistant: otwarcie drzwi zapala światło

6 września 2026