Producent rzadko wypisuje w dokumentacji nowego modelu listę rzeczy, które wyszły gorzej niż poprzednio. Anthropic wypisał siedem. Claude Fable 5.1 rzadziej wywołuje kilka narzędzi naraz, a przy niskim wysiłku chętniej odpowiada z pamięci, zamiast sprawdzić w sieci. Gdy ma poprawić w pliku trzy linijki, woli przepisać go w całości. W zamian przynosi jedną rzecz, która dla zostawiających agenta na kilka godzin waży więcej niż cała tabelka z wynikami. Odczyt z pamięci podręcznej kosztuje ćwierć tego, co kosztował.
Czym jest Claude Fable 5.1 i co zastępuje
Anthropic udostępnił model 1 września 2026, w dniu ogłoszenia. To następca Claude Fable 5, czyli najwyższej półki producenta, przeznaczonej do wymagającego rozumowania i do pracy agentowej ciągnącej się godzinami. W interfejsie programistycznym występuje pod nazwą claude-fable-5-1.
Podstawowe parametry zostały te same co u poprzednika. Okno kontekstu ma milion tokenów i jest to jednocześnie wartość domyślna i maksymalna. Model oddaje do 128 tysięcy tokenów w jednej odpowiedzi. Myślenie chodzi zawsze i nie da się go wyłączyć, a głębokość rozumowania ustawia się poziomem wysiłku. Ceny wejścia i wyjścia też się nie ruszyły, zmieniła się jedna pozycja cennika i to o niej jest następna sekcja.
Producent wymienia sześć obszarów, w których nowa wersja ma być lepsza od poprzedniej:
- długie sesje kodowania agentowego, w tym duże refaktoryzacje i migracje,
- praca z dokumentami, arkuszami i prezentacjami, od pierwszego pytania do gotowego pliku,
- wyszukiwanie i badania wieloetapowe,
- czytanie gęstych wykresów i tabel zaszytych w plikach PDF,
- rozumowanie na pełnym, milionowym oknie kontekstu,
- obsługa przeglądarki i programów na komputerze.
Wyniki wielojęzyczne zostają na poziomie poprzednika. Wszystkie te przewagi pochodzą z materiałów Anthropica, więc na razie są deklaracją, a nie pomiarem z zewnątrz.
Model działa w interfejsie programistycznym Anthropica, na Amazon Bedrock, w Google Cloud i w Microsoft Foundry. Jest też w aplikacjach Claude i w Claude Code, więc trafia do abonamentów, nie tylko do programistów. Równolegle powstała bliźniacza wersja Mythos 5.1 o tych samych parametrach i tej samej cenie, dostępna wyłącznie dla zatwierdzonych klientów programu Glasswing.
Ile kosztuje Claude Fable 5.1 i skąd się bierze te 75 procent
Cena wejścia i wyjścia nie drgnęła. Dalej jest to 10 dolarów za milion tokenów wejściowych i 50 dolarów za milion wyjściowych. Zmieniła się jedna pozycja w cenniku, za to mocno. Odczyt z pamięci podręcznej spadł z 1 dolara na 25 centów za milion tokenów.
To wygląda na drobiazg do momentu, w którym policzy się, na czym stoi długa sesja agentowa. Agent czytający ten sam początek rozmowy przy każdym kolejnym kroku płaci głównie za odczyty. Na pozostałych modelach Claude taki odczyt kosztuje jedną dziesiątą ceny wejścia. Tutaj kosztuje jedną czterdziestą. VentureBeat zwrócił uwagę na skutek uboczny: odczyt z tego modelu jest już tylko o jedną czwartą droższy niż z tańszego Sonneta 5, choć cena bazowa wejścia jest pięć razy wyższa.
Anthropic wylicza, że typowe obciążenie stanieje o 25 procent, a mocno agentowe nawet o 45. To rachunek producenta, nie pomiar niezależny, więc warto traktować go jako kierunek, a nie jako obietnicę. Sam kierunek jest jednak trudny do podważenia. Przetwarzanie wsadowe kosztuje połowę stawki, czyli 5 i 25 dolarów.
Benchmarki producenta mówią o przeskoku, niezależny ranking o remisie
Liczby z ogłoszenia Anthropica robią wrażenie. Na Terminal-Bench-Science 0.1, który mierzy agentową pracę badawczą, nowy model dostał 52,6 procent wobec 24,7 procent poprzednika. To ponad dwukrotność. Opus 5 ma w tym samym zestawieniu 29,0 procent, a GPT-5.6 Sol 22,4 procent. Na Terminal-Bench 4.0 wychodzi 55,8 wobec 42,0 dla Fable 5 i 52,3 dla Opus 5.
Wszystkie te pomiary wykonał sam Anthropic. Niezależny ewaluator Vals AI ustawia rzecz zupełnie inaczej. W jego zbiorczym indeksie Fable 5.1 zajmuje wprawdzie pierwsze miejsce, z wynikiem 67,87 procent, ale obok tej liczby stoi margines błędu 1,10 punktu. Opus 5 ma 67,21 procent, poprzedni Fable 5 ma 66,04. Przewaga nad Opus 5 wynosi więc 0,66 punktu i mieści się w całości wewnątrz marginesu błędu.
Ta różnica skali ma odbicie w samej dokumentacji. Anthropic radzi w niej, żeby większość zadań zaczynać od Opus 5. Po nowszy model każe sięgać przy wymagającym rozumowaniu i przy pracy ciągnącej się godzinami. Opus 5 kosztuje 5 dolarów za milion tokenów wejścia i 25 za milion wyjścia. To dokładnie połowa stawki Fable 5.1. Producent kieruje więc ruch z dala od własnej najdroższej pozycji w cenniku i jest to rekomendacja uczciwsza niż tabelka.
Wymuszone wywołanie narzędzia zwraca teraz błąd
Pierwsza zmiana psująca istniejący kod dotyczy wymuszania narzędzi. Parametr tool_choice ustawiony na any albo na konkretne narzędzie zwraca błąd 400. Zostają dwie wartości: domyślne auto oraz none. Ta sama walidacja obowiązuje przy liczeniu tokenów, więc nie da się jej ominąć bocznym wejściem.
Powód podany przez producenta jest o tyle rzadki, że jest argumentem, a nie eufemizmem. Myślenie w tym modelu chodzi zawsze, a wymuszone wywołanie narzędzia by je pomijało. Model wpisywałby wtedy rozumowanie w argumenty wywołania, co psuje ich jakość.
Zamienniki są trzy i wszystkie istniały wcześniej. Jeśli chodziło o zgodny ze schematem JSON, zostaje ścisłe użycie narzędzi z strict: true przy tool_choice: auto albo ustrukturyzowane wyjście. Jeśli chodziło o to, żeby model w ogóle sięgnął po narzędzie zamiast odpowiedzieć tekstem, wystarczy napisać to w poleceniu. Dokumentacja zapewnia, że model wykonuje takie instrukcje rzetelnie, a akurat to twierdzenie łatwo sprawdzić na własnym zestawie testów.
Bloki myślenia pilnują, żeby nikt nie majstrował przy historii
Druga i trzecia zmiana psująca dotyczą bloków myślenia i są ze sobą powiązane. Każdy taki blok zapamiętuje dwie rzeczy: który model go wyprodukował oraz jak wyglądała rozmowa przed nim.
Zgodność działa tylko w jedną stronę. Nowy model czyta bloki myślenia starszych modeli, żaden starszy nie odczyta bloków nowego. Rozmowa przeniesiona na Fable 5.1 zachowuje więc swoje rozumowanie, a przeniesiona z powrotem traci je na tych turach, które pobiegną gdzie indziej. Przy przełączaniu modeli w locie interfejs wycina taki blok, zanim model go zobaczy, i nie dolicza go do tokenów wejściowych.
Poważniejsza jest reguła druga. Zmiana czegokolwiek przed blokiem myślenia unieważnia ten blok i wszystkie następne po nim. Chodzi o polecenie systemowe, listę narzędzi i wcześniejsze wiadomości. Kolejne żądanie kończy się wtedy błędem 400 z komunikatem, że blok należy do innej rozmowy.
Które nawyki przestają działać
- Edytowanie, przestawianie albo usuwanie wcześniejszej tury przy zachowaniu późniejszych.
- Wstrzykiwanie przypomnienia do starszej wiadomości i kasowanie go przy następnym żądaniu.
- Przebudowa polecenia systemowego albo listy narzędzi w trakcie tej samej rozmowy.
- Adres obrazu lub dokumentu, który przy kolejnym żądaniu serwuje inne bajty. Sprawdzana jest zawartość, nie adres, więc podpisany link z rotacją do tego samego pliku jest bezpieczny.
Co nadal jest bezpieczne
- Serwerowe skracanie kontekstu i kompaktowanie historii.
- Przesuwanie znaczników pamięci podręcznej.
- Zmiana poziomu wysiłku między żądaniami.
- Usuwanie bloków myślenia od najstarszego, ciągiem od początku rozmowy.
Kontrola jest egzekwowana dla kont założonych 31 sierpnia 2026 i później. Na starszych kontach interfejs samą niezgodność odnotowuje, ale reaguje na nią wyłącznie wtedy, gdy żądanie poprosi o to osobnym parametrem. Kto pracuje w Claude Code, w aplikacji Claude albo na Agent SDK, nie zauważy niczego, bo te narzędzia pilnują historii za użytkownika. Kto sam składa tablicę wiadomości, ma tu realną robotę do wykonania przed migracją.
Siedem rzeczy, które wyszły gorzej niż w poprzedniku
Sekcja dokumentacji zatytułowana wprost “zmienione wobec Claude Fable 5” jest najciekawszą częścią całego wydania, bo producenci rzadko piszą takie rzeczy sami o sobie.
- Rzadsze równoległe wywołania narzędzi. Tam, gdzie poprzednik pobierał kilka rzeczy naraz, nowy model potrafi pójść po jednej na turę. Jakość odpowiedzi na tym nie cierpi, rośnie za to liczba tur, rachunek i czas na zegarze.
- Mniej komunikatów o postępie. Model pisze mniej tekstu między wywołaniami narzędzi, zwłaszcza przy wysokim wysiłku. Długa tura potrafi wyglądać w interfejsie na zawieszoną.
- Rzadsze sięganie po wyszukiwarkę przy niskim wysiłku. Model odpowiada z pamięci zamiast sprawdzić w sieci.
- Gęstsza proza. Dłuższe zdania, mniej akapitów.
- Mniej formatowania w rozmowie. Rzadziej używa pogrubień, nagłówków i list, więc zakazy formatowania pisane pod starsze modele mogą teraz wycinać strukturę, która jest potrzebna.
- Cytaty bez oznaczenia. Przy streszczaniu dokumentów model częściej przepisuje fragmenty źródła, nie zaznaczając, że to cytat.
- Przepisywanie całych plików. Przy drobnej zmianie częściej przepisuje plik w całości, zamiast poprawić fragment. Wynik zwykle wychodzi ten sam, tokeny wyjściowe już nie.
Sześć pozycji z tej listy widać na fakturze albo w interfejsie. Jedna jest innego rodzaju. Nieoznaczone cytaty wychodzą dopiero u odbiorcy i to jedyna rzecz z tego zestawu, którą trzeba sprawdzać ręcznie, zanim tekst z modelu pójdzie dalej.
Pierwsza Misja AI · Kodożercy
AI zmienia rynek pracy. Zacznij rozumieć o co chodzi.
Kurs Pierwsza Misja AI to najkrótszy kurs, po którym naprawdę rozumiesz AI, a na koniec możesz to pokazać certyfikatem. Fabuła w konwencji science fiction i gamifikacja sprawiają, że nie nudzisz się ani minuty.
Dołącz do kursantów →

Znak wodny w każdym tekście, a w tle unijne obowiązki
Każdy tekst wyprodukowany przez ten model niesie statystyczny znak wodny Anthropica, na wszystkich platformach, na których model jest dostępny. Producent zapewnia, że znak nie zmienia treści ani czytelności, nie dokłada tokenów, nie chowa w tekście dodatkowych znaków i nie niesie informacji o tym, kto pytał. Obrazy i wideo wytworzone przez narzędzie wykonywania kodu dostają podpisane poświadczenia C2PA przy pobraniu przez API plików.
Anthropic nazywa to pochodzeniem treści i nie wiąże wprost z żadną regulacją. Warto jednak zobaczyć, w jakim momencie ta funkcja wchodzi. Od 2 sierpnia 2026 stosuje się artykuł 50 unijnego aktu o sztucznej inteligencji, czyli obowiązki przejrzystości. Wymienia on znaki wodne, znakowanie metadanymi i mechanizmy uwierzytelniania pochodzenia jako dopuszczalne sposoby oznaczania treści wytworzonej maszynowo. Za naruszenie grozi kara do 15 milionów euro albo 3 procent światowego obrotu.
Potrzebne jest tu jedno zastrzeżenie, bo łatwo wyciągnąć z tego zły wniosek. Znak wodny dostawcy modelu sam z siebie nie przesądza, że stosujący ten model wywiązał się z własnych obowiązków. Artykuł 50 nakłada je w konkretnych sytuacjach, między innymi przy chatbotach i przy materiałach udających autentyczne nagranie albo zdjęcie. Czy akurat twój przypadek pod nie podpada, trzeba sprawdzić osobno, a nie założyć na podstawie samej funkcji w modelu. O tym, co dokładnie wchodzi i w jakich terminach, pisaliśmy przy okazji harmonogramu AI Act dla firm.
Najczęstsze pytania
Czy Claude Fable 5.1 zastępuje Opus 5?
Nie i producent sam tego nie sugeruje. Dokumentacja radzi zaczynać większość zadań od Opus 5, a po nowszy model sięgać przy wymagającym rozumowaniu i przy pracy agentowej ciągnącej się godzinami. Opus 5 kosztuje przy tym połowę mniej za tokeny, więc decyzję lepiej oprzeć na własnym zestawie testów niż na zbiorczym rankingu.
Czy przejście z Fable 5 wymaga zmian w kodzie?
Tak, w trzech miejscach. Trzeba usunąć wymuszanie narzędzi przez tool_choice, przestać przepisywać historię rozmowy wstecz i sprawdzić, czy kod nie wstrzykuje do wcześniejszych tur tekstu, który potem kasuje. Sama podmiana nazwy modelu to jedna linijka. Reszta pracy siedzi w tym, jak aplikacja buduje tablicę wiadomości. Kto korzysta z Claude Code albo z aplikacji Claude, nie musi robić nic.
Migrować od razu czy poczekać?
Przy gotowych narzędziach Anthropica nie ma na co czekać, bo zmiana sprowadza się do wyboru modelu z listy. Przy własnej integracji rozsądniej najpierw przejść trzy punkty migracji na środowisku testowym, a dopiero potem przełączać ruch. Największą niewiadomą nie są bramki zwracające błąd od razu, bo te widać w pierwszej minucie. Ryzyko siedzi w udokumentowanych zmianach zachowania, a te wychodzą dopiero na własnych zadaniach.
Podsumowanie
Nowy model Anthropica nie jest tym przeskokiem, na jaki wygląda w tabelkach producenta. Niezależny ranking daje mu przewagę nad Opus 5 mieszczącą się w marginesie błędu, a sam Anthropic radzi zaczynać od tańszego modelu. Realną zmianą jest cena odczytów z pamięci podręcznej, bo to ona decyduje, czy agenta opłaca się zostawić na kilka godzin bez nadzoru. Ta zmiana ma jednak swój koszt i płaci go zespół, nie model. Wymuszone wywołanie narzędzia przestaje działać, historii rozmowy nie wolno już swobodnie przepisywać wstecz, a siedem udokumentowanych regresji trzeba przejść na własnych testach. Kto pracuje na gotowych narzędziach Anthropica, początku rozmowy nie musi pilnować sam. Zmienione zachowanie modelu zobaczy jednak tak samo. Kto sam składa żądania do API, ma przed sobą wieczór z dokumentacją zmian.
Newsletter · DevstockAcademy & Kodożercy
Bądź na bieżąco ze światem IT, AI i automatyzacji
Co wtorek: newsy z branży, praktyczne tipy i narzędzia które warto znać. Zero spamu.




