AI-TOP.PL · aktualności
Nowe modele Claude: Anthropic nie zbudował jednego zwycięzcy, lecz całą drabinę agentów AI

W ciągu kilku tygodni Anthropic istotnie przebudował swoją ofertę modeli. Pojawiły się Claude Opus 4.8, Claude Fable 5, ograniczony dostępem Claude Mythos 5 oraz Claude Sonnet 5.
Na pierwszy rzut oka można potraktować te premiery jako kolejne zwiększanie numerów wersji. Z punktu widzenia architektury rozwiązań ważniejsze jest jednak coś innego: Anthropic przestaje rozwijać jedną prostą linię modeli od taniego do inteligentnego. Buduje portfolio przeznaczone dla różnych klas pracy agentowej.
Nie ma więc jednego „nowego Claude’a”.
Są modele do masowej realizacji procesów, trudnych zadań przedsiębiorstw, długotrwałej autonomicznej pracy oraz specjalistycznych operacji związanych z cyberbezpieczeństwem.
Sonnet 5: model roboczy dla agentów
Claude Sonnet 5 został przedstawiony jako model łączący szybkość i wysokie możliwości. Największe zmiany względem Sonnet 4.6 dotyczą kodowania oraz zadań agentowych — planowania, korzystania z narzędzi i wykonywania wieloetapowej pracy. Anthropic utrzymał podstawowy cennik na poziomie 3 dolarów za milion tokenów wejściowych i 15 dolarów za milion tokenów wyjściowych, przy czym do 31 sierpnia 2026 roku obowiązuje cena promocyjna 2 i 10 dolarów.
Sonnet 5 otrzymał kontekst o długości miliona tokenów oraz możliwość wygenerowania do 128 tysięcy tokenów wyjściowych. Parametry te są obecnie wspólne również dla mocniejszych modeli Anthropic.
Nie oznacza to jednak, że migracja z Sonnet 4.6 jest neutralna kosztowo. Nowy tokenizer tworzy dla tego samego tekstu około 30% więcej tokenów. Cena jednostkowa pozostała zbliżona, ale koszt przetworzenia identycznego dokumentu lub konwersacji może wzrosnąć.
To ważny przykład różnicy pomiędzy cennikiem a ekonomią procesu.
Model może kosztować tyle samo „za milion”, ale zużywać więcej milionów.
Sonnet 5 należy więc oceniać nie tylko według ceny tokenu, lecz według liczby poprawnie zakończonych zadań. Jeżeli lepiej planuje, rzadziej powtarza operacje i sprawniej korzysta z narzędzi, wyższa tokenizacja może zostać zrekompensowana przez krótszy przebieg procesu.
Opus 4.8: trudne zadania bez przejścia do najdroższej klasy
Claude Opus 4.8 jest modelem przeznaczonym do złożonego kodowania agentowego i pracy przedsiębiorstw. Kosztuje 5 dolarów za milion tokenów wejściowych i 25 dolarów za milion wyjściowych. Oferuje milion tokenów kontekstu, 128 tysięcy tokenów wyjścia oraz adaptacyjne wnioskowanie.
W porównaniu z Opus 4.7 rozwinięto przede wszystkim trzy obszary:
- utrzymywanie jakości podczas długotrwałych zadań,
- dobieranie wysiłku wnioskowania do problemu,
- bardziej niezawodne uruchamianie potrzebnych narzędzi.
Model ma rzadziej pomijać wymagane wywołanie narzędzia oraz lepiej odzyskiwać kontekst po jego kompresji. W długich sesjach agentowych jest to często ważniejsze niż kolejny punkt benchmarku. Agent, który po kilku godzinach zapomina cel albo omija testy, może być bardzo inteligentny — tylko chwilowo mało użyteczny.
Opus 4.8 obsługuje również eksperymentalny tryb przyspieszony, zapewniający do 2,5 raza większą szybkość generowania za wyższą opłatą. Pozwala to traktować szybkość jako parametr usługi, a nie stałą właściwość modelu.
Fable 5: model dla najtrudniejszych problemów
Claude Fable 5 jest najpotężniejszym modelem Anthropic dostępnym w szerokiej dystrybucji. Został zaprojektowany dla problemów długotrwałych, złożonych i niejednoznacznych — takich, których realizacja przez człowieka może wymagać godzin, dni lub tygodni.
Kosztuje 10 dolarów za milion tokenów wejściowych i 50 dolarów za milion tokenów wyjściowych. Podobnie jak Opus 4.8 posiada milion tokenów kontekstu i limit 128 tysięcy tokenów odpowiedzi.
Dwukrotnie wyższa cena względem Opus 4.8 nie oznacza automatycznie dwukrotnie większej wartości. Fable 5 powinien być kierowany do zadań, w których koszt błędnej lub niepełnej realizacji jest znacznie większy niż koszt samego modelu.
Nie jest więc naturalnym wyborem do prostego streszczania wiadomości, klasyfikacji zgłoszeń czy masowego generowania opisów produktów.
To model przeznaczony raczej do:
- prowadzenia złożonych analiz,
- długotrwałego rozwoju oprogramowania,
- koordynowania wielu narzędzi i etapów,
- rozwiązywania najtrudniejszej części procesu.
Fable 5 posiada zawsze aktywne adaptacyjne wnioskowanie. Wprowadza też dodatkową warstwę klasyfikatorów bezpieczeństwa, która może odmówić wykonania części zapytań. Odmowa zwracana jest jako poprawna odpowiedź API ze statusem stop_reason: refusal, a nie jako klasyczny błąd techniczny. Integracja powinna więc posiadać obsługę takiego stanu oraz model rezerwowy.
Mythos 5: ten sam model, inny poziom dostępu
Claude Mythos 5 korzysta z tych samych podstawowych możliwości i parametrów co Fable 5, ale jest udostępniany wyłącznie zatwierdzonym podmiotom w ramach programu Project Glasswing. Model został przeznaczony przede wszystkim do zaawansowanych, autoryzowanych zadań cyberbezpieczeństwa i nie posiada części klasyfikatorów stosowanych w Fable 5.
Nie powinien być więc traktowany jako zwykła alternatywa dla użytkownika API. To osobna klasa dostępu, powiązana z oceną podmiotu i charakteru jego działalności.
Mythos pokazuje jednak kierunek rozwoju rynku: ten sam poziom inteligencji może być udostępniany z innym zakresem funkcji w zależności od zaufania, ryzyka i celu wykorzystania.
Ważne ograniczenie: retencja danych
Fable 5 i Mythos 5 wymagają trzydziestodniowej retencji danych i nie są dostępne w konfiguracji Zero Data Retention. Dla organizacji przetwarzających poufne dane może to być ważniejszym kryterium niż wynik benchmarku. Opus 4.8 pozostaje dostępny w środowiskach ZDR i może być właściwszym rozwiązaniem mimo niższego poziomu deklarowanych możliwości.
To dobry przykład, dlaczego ranking ogólny nie powinien automatycznie wskazywać modelu do wdrożenia.
Najbardziej inteligentny model może odpaść już na etapie wymagań dotyczących danych.
Jak czytać nowe portfolio Claude?
Nową ofertę Anthropic można interpretować jako czteropoziomową architekturę:
Sonnet 5 — podstawowy model do masowych procesów agentowych, kodowania i pracy wymagającej dobrej relacji jakości do kosztu.
Opus 4.8 — model dla trudniejszych zadań, długich kontekstów oraz procesów wymagających większej niezawodności i możliwości stosowania ZDR.
Fable 5 — model do najtrudniejszych, długotrwałych problemów, w których wysoki koszt pojedynczego wywołania może być uzasadniony wartością końcowego wyniku.
Mythos 5 — specjalistyczna wersja o ograniczonym dostępie, przeznaczona do zaawansowanego cyberbezpieczeństwa.
W dojrzałym systemie nie trzeba wybierać tylko jednego z nich.
Sonnet może obsługiwać większość operacji. Opus przejmować trudniejsze przypadki. Fable być uruchamiany wtedy, gdy pozostałe modele nie osiągnęły akceptowalnego wyniku.
Największą zmianą nie jest więc pojawienie się nowego lidera.
Jest nią możliwość projektowania routingu zadań wewnątrz jednej rodziny modeli.
Wniosek AI-TOP.PL
Nowe modele Claude powinny być porównywane w kontekście roli, a nie wyłącznie miejsca w rankingu.
Fable 5 może uzyskać najwyższą ocenę jakości, lecz jego cena, retencja danych i mechanizmy odmowy ograniczają liczbę racjonalnych zastosowań. Sonnet 5 może przegrać część benchmarków, a jednocześnie być najlepszym modelem produkcyjnym dla dużej liczby procesów.
Najlepszy Claude nie jest więc zawsze największym Claude’em.
Jest nim model, który realizuje określone zadanie przy akceptowalnym koszcie, ryzyku i poziomie nadzoru.