AI · 26 września 2026

Anthropic i OpenAI prezentują nową generację modeli sztucznej inteligencji

Woman typing on laptop at wooden table with breakfast
Microsoft Copilot / Unsplash

Firmy Anthropic oraz OpenAI zaprezentowały nowe generacje swoich modeli sztucznej inteligencji, mimo że mniej niż dwa tygodnie wcześniej ich kierownictwo wzywało do spowolnienia wyścigu w rozwoju najbardziej zaawansowanych systemów ze względu na rosnące ryzyko.

Anthropic wprowadziła model Claude Opus 5.5, który jest wiodącym rozwiązaniem w jej nowej rodzinie modeli. System ten oferuje wydajność porównywalną z modelem Fable 5.1, przy jednoczesnym obniżeniu całkowitych kosztów operacyjnych o około 40 procent w stosunku do wersji Opus 5 oraz zwiększeniu szybkości odpowiedzi o ponad 30 procent. Ceny interfejsu programistycznego aplikacji zostały zredukowane do 4 dolarów za milion tokenów wejściowych i 20 dolarów za tokeny wyjściowe, a koszty odczytu pamięci podręcznej spadły o 60 procent. Firma skupiła się również na eliminacji stylu wypowiedzi określanego jako Claudish, który był krytykowany przez profesjonalnych użytkowników za bycie rozwlekłym i przepełnionym żargonem, na rzecz komunikacji konkretnej i jasnej.

OpenAI ogłosiła natomiast wprowadzenie modeli GPT-6 Sol oraz GPT-6 Luna, co nastąpiło mniej niż trzy miesiące po premierze serii 5.6. Według danych firmy, główny model roboczy Sol redukuje liczbę błędów faktycznych o połowę w porównaniu do swojego poprzednika, a ceny interfejsu programistycznego aplikacji zostały obniżone o około 50 procent względem poprzednich cen premierowych. Tańszy model, Luna, zapewnia wydajność równą zaawansowanym modelom roboczym z poprzedniej generacji, oferując przy tym lepszą stabilność i ściślejsze przestrzeganie instrukcji bezpieczeństwa.

Niezależne testy wydajności wskazują na różne obszary dominacji obu firm. Model Opus 5.5 zajął pierwsze miejsce w branży w rankingu platformy Artificial Analysis z wynikiem 58 punktów i prowadzi w sześciu z dziesięciu kluczowych testów. W teście Humanity's Last Exam osiągnął 67,7 procent dokładności przy użyciu narzędzi, podczas gdy GPT-6 Astra uzyskał 57,2 procent. W zakresie pisania kodu i obsługi autonomicznych agentów w teście Terminal-Bench 4.0 Opus 5.5 uzyskał 66,4 procent, wyprzedzając wynik 57,9 procent GPT-6 Astra. Z kolei OpenAI utrzymuje przewagę w złożonych procesach biznesowych w teście AutomationBench, gdzie Astra uzyskała 41,4 procent przeciwko 40,0 procent Opus 5.5, oraz w autonomicznym badaniu naukowym w teście Terminal-Bench-Science z wynikiem 64,6 procent wobec 58,7 procent Anthropic.

Obniżki cen są wynikiem presji konkurencyjnej ze strony firm z Europy, Stanów Zjednoczonych i Chin, szczególnie tych ostatnich, które oferują konkurencyjne modele przy bardzo niskich kosztach. Dodatkowo regulacje międzynarodowe, w tym europejski akt o sztucznej inteligencji, wymuszają na producentach stosowanie mechanizmów znakowania, polityki zerowego przechowywania danych oraz zabezpieczeń przed atakami destylacyjnymi. Nowe podejście odzwierciedla przejście od rywalizacji o wielkość modeli do walki o wydajność obliczeniową i minimalizację kosztów operacyjnych w centrach danych, które borykają się z ograniczeniami w dostawach energii i dostępności akceleratorów graficznych. Zastosowanie technologii pamięci podręcznej dla poleceń pozwala oszczędzać energię elektryczną i zasoby pamięci, co umożliwia zwiększenie skali działalności bez konieczności budowy nowych elektrowni.