Claude AI

Claude Opus 5 oficjalnie. Anthropic rzuca wyzwanie OpenAI i Google

Anthropic zaprezentował Claude Opus 5 – nowy flagowy model sztucznej inteligencji, który ma wyznaczyć nowe standardy w programowaniu, automatyzacji procesów biznesowych i pracy z wiedzą. Według firmy model osiąga najlepsze wyniki w wielu uznanych benchmarkach, jednocześnie utrzymując taki sam koszt korzystania jak poprzednia generacja Claude Opus 4.8.

Rynek zaawansowanych modeli AI staje się coraz bardziej konkurencyjny. Po premierach kolejnych modeli OpenAI, Google czy xAI również Anthropic nie zamierza oddawać pola. Firma przekonuje, że Claude Opus 5 nie jest już narzędziem przeznaczonym wyłącznie do najbardziej wymagających zadań, ale modelem, który może być wykorzystywany na co dzień przez programistów, analityków i przedsiębiorstwa.

Claude Opus 5 zachowuje ceny poprzednika

Nowy model jest dostępny od razu we wszystkich usługach Anthropic. Cennik pozostał identyczny jak w przypadku Claude Opus 4.8 i wynosi:

  • 5 dolarów za milion tokenów wejściowych,
  • 25 dolarów za milion tokenów wyjściowych.

Producent udostępnił również szybszy wariant modelu, który działa około 2,5 raza szybciej od standardowej wersji. Korzystanie z niego wiąże się jednak z dwukrotnie wyższym kosztem.

Rekordowe wyniki w programowaniu

Największym atutem Claude Opus 5 mają być zadania związane z tworzeniem oprogramowania.

Według Anthropic model osiągnął najlepszy wynik spośród testowanych systemów w benchmarku Frontier-Bench v0.1, który koncentruje się na zaawansowanych zadaniach inżynierii oprogramowania. Jednocześnie miał ponad dwukrotnie poprawić skuteczność względem Claude Opus 4.8 przy niższym koszcie wykonania pojedynczego zadania.

Bardzo dobrze wypadł również w CursorBench 3.2, gdzie przy maksymalnym poziomie wysiłku uzyskał rezultat zaledwie o 0,5 punktu procentowego niższy od modelu Claude Fable 5, kosztując przy tym około połowę tego, co konkurencyjne rozwiązanie.

Nie tylko kod. AI radzi sobie także z nauką i biznesem

Anthropic podkreśla, że Claude Opus 5 nie został zaprojektowany wyłącznie z myślą o programistach.

Model osiągnął bardzo wysokie wyniki również w:

  • ARC-AGI 3 – benchmarku badającym zdolność AI do rozwiązywania zupełnie nowych problemów, gdzie miał uzyskać wynik trzykrotnie lepszy od kolejnego najlepszego modelu,
  • Zapier AutomationBench, oceniającym automatyzację procesów biznesowych od początku do końca,
  • OSWorld 2.0, sprawdzającym możliwości wykonywania zadań bezpośrednio na komputerze użytkownika.

Według Anthropic nowy model oferuje znacznie lepszy stosunek wydajności do kosztów niż konkurencyjne rozwiązania.

Lepszy również w badaniach naukowych

Firma zwraca uwagę także na zastosowania naukowe.

W wewnętrznych testach dotyczących chemii organicznej Claude Opus 5 uzyskał wynik o 10,2 punktu procentowegolepszy od Claude Opus 4.8. Poprawę odnotowano również podczas analiz wpływu zmian w sekwencjach białek na ich funkcjonowanie, gdzie model osiągnął wynik wyższy o 7,7 punktu procentowego.

Choć są to testy przygotowane przez samą firmę i nie stanowią niezależnej oceny, pokazują kierunek, w którym Anthropic rozwija swoje modele.

Model potrafi sam znaleźć nowe rozwiązanie problemu

Jednym z ciekawszych przykładów zaprezentowanych przez Anthropic jest eksperyment polegający na odtworzeniu elementu mechanicznego w programie FreeCAD.

Model otrzymał jedynie obraz części i nie miał możliwości bezpośredniego obejrzenia go. Zamiast zrezygnować z zadania, sam stworzył własny system analizy obrazu, który wyodrębnił geometrię z surowych pikseli, a następnie wykorzystał te informacje do zbudowania poprawnego modelu 3D.

Według Anthropic Claude Opus 5 wielokrotnie powtórzył ten sukces, podczas gdy konkurencyjne modele nie potrafiły ukończyć zadania nawet po kilku próbach.

Mocniejsze zabezpieczenia przed nadużyciami

Rosnące możliwości modeli AI oznaczają również większe ryzyko ich niewłaściwego wykorzystania.

Dlatego Anthropic wprowadził dodatkowe mechanizmy bezpieczeństwa. Firma twierdzi, że Claude Opus 5 jest najlepiej dostosowanym do ludzkich intencji modelem w swojej historii i wykazuje mniejszą skłonność do zachowań uznawanych za wprowadzające w błąd niż wcześniejsze generacje.

Jednocześnie ograniczono możliwość wykonywania niektórych zadań związanych z cyberbezpieczeństwem, takich jak:

  • skanowanie podatności binarnych,
  • testy penetracyjne,
  • generowanie exploitów.

Jeżeli system uzna zapytanie za potencjalnie niebezpieczne, może automatycznie przekierować je do starszego modelu Claude Opus 4.8.

Anthropic stawia na praktyczne zastosowania

Premiera Claude Opus 5 pokazuje, że rywalizacja pomiędzy największymi twórcami modeli AI coraz bardziej koncentruje się nie tylko na samych benchmarkach, ale również na wydajności kosztowej i codziennym zastosowaniu modeli.

Anthropic przekonuje, że nowy Claude Opus 5 ma być narzędziem, z którego użytkownicy będą korzystać regularnie – zarówno podczas programowania, automatyzacji procesów biznesowych, jak i prowadzenia badań naukowych. Jeśli deklarowane wyniki znajdą potwierdzenie w niezależnych testach, nowy model może stać się jednym z najpoważniejszych konkurentów dla najnowszych modeli OpenAI, Google czy xAI.

Foto: DepositPhotos.

Podziel się artykułem

PortalTechnologiczny.pl

Wykorzystujemy ciasteczka do spersonalizowania treści i reklam, aby oferować funkcje społecznościowe i analizować ruch w naszej witrynie.

Informacje o tym, jak korzystasz z naszej witryny, udostępniamy partnerom społecznościowym, reklamowym i analitycznym. Partnerzy mogą połączyć te informacje z innymi danymi otrzymanymi od Ciebie lub uzyskanymi podczas korzystania z ich usług.

Informacja o tym, w jaki sposób Google przetwarza dane, znajdują się tutaj.