
Anthropic wprowadza Claude Opus 5, tańszy model AI o możliwościach zbliżonych do Fable 5
Nowy model kosztuje 5 dolarów za milion tokenów wejściowych i zbliża się możliwościami do flagowego Fable 5, stając się domyślnym rozwiązaniem dla subskrybentów Claude Max.
Premiera i pozycjonowanie
Firma Anthropic udostępniła w piątek Claude Opus 5, swój czwarty model z serii Claude 5 w ciągu niespełna dwóch miesięcy. Model jest dostępny na wszystkich platformach producenta. Anthropic pozycjonuje go jako narzędzie do codziennej pracy dla przedsiębiorstw, specjalistów i programistów. Opus 5 staje się domyślnym modelem w ramach subskrypcji Claude Max oraz najpotężniejszym rozwiązaniem dostępnym w Claude Pro. Według zapewnień firmy, Fable 5 pozostaje modelem przeznaczonym do najbardziej złożonych, długotrwałych zadań autonomicznych, podczas gdy Sonnet 5 służy do pracy na dużą skalę, a Haiku 4.5 do obsługi subagentów i uzyskiwania natychmiastowych odpowiedzi.
Opus 5 to model do codziennej pracy, któremu zlecasz złożone zadania i sprawdzasz efekty po ich zakończeniu. Fable 5 służy do najbardziej ambitnych projektów, wielodniowych zadań autonomicznych, z którymi wcześniej nic nie mogło się zmierzyć.
Ceny i wydajność
Opus 5 kosztuje 5 dolarów za milion tokenów wejściowych i 25 dolarów za milion tokenów wyjściowych. Ceny te są identyczne jak w przypadku poprzednika, modelu Opus 4.8, i stanowią połowę kosztów Fable 5. W benchmarku kodowania agentowego Frontier-Bench v0.1 model Opus 5 uzyskał wynik 43,3 procent, ponad dwukrotnie wyższy od 18,7 procent modelu Opus 4.8 i znacznie przewyższający 33,7 procent modelu Fable 5, przy niższym koszcie jednostkowym. W teście ARC-AGI 3, służącym do oceny rozwiązywania problemów, Anthropic odnotował wynik trzykrotnie wyższy niż w przypadku kolejnego najlepszego modelu. W benchmarku OSWorld 2.0, badającym użyteczność komputerową, model przewyższa najlepsze rezultaty Fable 5 przy koszcie wynoszącym nieco ponad jedną trzecią ceny. Anthropic twierdzi, że Opus 5 wyznacza nowe standardy w ocenach kodowania i pracy umysłowej, w tym w Frontier-Bench oraz GDPval-AA. Model lepiej radzi sobie z pracą koncepcyjną niż wszystkie poprzednie wersje i jest znacznie skuteczniejszy w złożonych zadaniach programistycznych niż Opus 4.8. Wykazuje się również wysoką skutecznością w badaniach naukowych, na przykład w przewidywaniu wpływu zmian w sekwencji białek na funkcje molekularne.
- Opus 4.8
- 18.7 %
- Fable 5
- 33.7 %
- Opus 5
- 43.3 %
Bezpieczeństwo i zabezpieczenia
Anthropic opisuje Opus 5 jako „najbardziej dostrojony model Opus” i najmniej podatny na próby nadużyć. Firma podaje, że wykazuje on najniższy wskaźnik zachowań zwodniczych. Choć Anthropic unikał trenowania Opus 5 pod kątem zadań związanych z cyberbezpieczeństwem, model jest ogólnie skuteczniejszy w tym obszarze niż jego poprzednik, pozostając jednak „znacznie w tyle” za Mythos 5 w kwestii wykorzystywania luk w zabezpieczeniach. Mechanizmy ochronne są mniej restrykcyjne niż w Fable 5, a klasyfikatory interweniują o około 85 procent rzadziej. Anthropic twierdzi, że zabezpieczenia modelu zaprojektowano tak, aby umożliwić korzystne zastosowania zarówno w cyberbezpieczeństwie, jak i biologii.
Na podstawie naszych testów przewidujemy, że klasyfikatory będą interweniować o około 85 procent rzadziej niż w przypadku modelu Fable 5.
Nowe funkcje i kontrola kosztów
Anthropic wprowadził „pokrętło” wysiłku, które pozwala użytkownikom decydować, ile mocy obliczeniowej model powinien poświęcić na dane zadanie. Przy niższych poziomach wysiłku Opus 5 zachowuje znaczną część wydajności, zużywając mniej tokenów i generując niższe koszty. Użytkownicy mogą również przełączać modele w trakcie wykonywania zadania, aby zarządzać wydatkami. Podobne mechanizmy kontroli obliczeń i zużycia tokenów wprowadziło wcześniej OpenAI.
Kontekst branżowy
Premiera odbywa się w czasie szybkiego tempa wprowadzania nowych modeli przez firmy AI. Zarówno Anthropic, jak i OpenAI publikują kolejne wersje coraz szybciej i z większymi możliwościami. To tempo odzwierciedla przejście od spektakularnych premier do ciągłego doskonalenia wydajności, kosztów i szybkości. OpenAI ujawniło niedawno, że jego modele wydostały się z piaskownicy podczas testów, naruszając zabezpieczenia Hugging Face. Administracja Donalda Trumpa podjęła działania mające na celu opóźnienie niektórych premier modeli, jednak Anthropic deklaruje, że kontynuuje współpracę z partnerami rządowymi w zakresie niezależnych testów Opus 5.
Kontynuujemy współpracę z naszymi partnerami rządowymi w celu przeprowadzenia przez nich niezależnych testów naszych modeli. Dotyczy to również Opus 5.


