Tag: Claude Opus 4.8

  • Claude Opus 4.8 wchodzi do gry: adaptacyjne myślenie i milion tokenów kontekstu na pokładzie

    Claude Opus 4.8 wchodzi do gry: adaptacyjne myślenie i milion tokenów kontekstu na pokładzie

    Anthropic wypuścił 28 maja 2026 roku Claude Opus 4.8, który jest najnowszym modelem w swojej serii. Został zaprojektowany do wykonywania autonomicznych zadań agentowych, złożonego kodowania oraz pracy z wiedzą profesjonalną. Model oferuje domyślnie okno kontekstowe o wielkości miliona tokenów i rezygnuje z ręcznego przełącznika extended thinking na rzecz w pełni adaptacyjnego podejścia do głębokości rozumowania.

    Co nowego w pigułce

    • Adaptive Thinking zastępuje dotychczasowy mechanizm extended thinking — model sam decyduje, jak głęboko analizować problem.
    • Okno kontekstowe 1M tokenów dostępne domyślnie, z maksymalną długością wyjściową 128 tysięcy tokenów.
    • Wydajność w kodowaniu wzrasta do 88,6% na SWE-bench Verified, a model czterokrotnie rzadziej przeocza błędy w kodzie.
    • Dynamic Workflows w Claude Code umożliwia natywną koordynację dziesiątek, a nawet setek równoległych podagentów.
    • Ceny bez zmian względem Claude Opus 4.8 — 5 dolarów za milion tokenów wejściowych i 25 za wyjściowe, z opcjonalnym trybem Fast Mode.

    Nie chodzi już o gadanie — to maszyna do długich zadań

    Opus 4.8 to nie tylko odświeżenie. Anthropic przesuwa akcent z "modelu językowego" na "agenta produkcyjnego". W benchmarkach widać to wyraźnie: SWE-bench Verified na poziomie 88,6% to znaczący postęp, który czyni ten model realnym współpracownikiem programisty. Wersja Pro tego samego testu osiąga wzrost o 4,9 punktu procentowego — do 69,2%.

    Model jako pierwszy w chmurze osiąga zero procent zgłaszania błędnych wyników bez ich krytycznej oceny. Jeśli coś jest nie tak, Opus 4.8 sam to wyłapie i zakomunikuje, zamiast udawać, że wszystko jest w porządku. To podejście do kwestii zaufania w narzędziach agentowych jest istotne.

    Największą różnicę czuć w przepływie pracy. Model radzi sobie z zadaniami wieloetapowymi, gdzie wykonanie kodu przeplata się z analizą wyników i korektą strategii. Użytkownik nie musi go prowadzić — model dostaje cel, rozkłada go na części, wykonuje i sprawdza efekty.

    Adaptive Thinking i kontrola wysiłku

    Adaptive Thinking i kontrola wysiłku

    Brak osobnego przełącznika extended thinking to nie tylko kosmetyka. Adaptive Thinking oznacza, że model sam decyduje, kiedy warto pomyśleć dłużej, a kiedy odpowiedź jest oczywista. Użytkownicy claude.ai mają dodatkowo selektor wysiłku, co pozwala im kontrolować, ile "energii" obliczeniowej model poświęca na dane zadanie.

    To podejście ma sens. Nie każdy prompt wymaga głębokiej analizy, a płacenie za zbędne tokeny w prostych zapytaniach mogło być frustrujące. Teraz model decyduje, a użytkownik może dostosować intensywność.

    Opus 4.8 obsługuje ponad 80 języków i był trenowany na danych do stycznia 2026 roku. Kontekst miliona tokenów w połączeniu z adaptacyjnym myśleniem sprawia, że narzędzie dobrze radzi sobie w analizie obszernych repozytoriów czy dokumentacji.

    Nowości w API i Claude Code

    Nowości w API i Claude Code

    Równolegle z modelem Anthropic wprowadza kilka istotnych zmian platformowych. Pojawiły się wiadomości systemowe w trakcie konwersacji, co jest przydatne, gdy trzeba dynamicznie zmienić zachowanie modelu bez resetowania całego kontekstu. Rozszerzono również kategorie odrzuceń w Messages API, co daje większą kontrolę nad tym, kiedy i dlaczego asystent odmawia odpowiedzi.

    Dla zespołów DevOps kluczową nowością są Dynamic Workflows w Claude Code. Mechanizm ten pozwala uruchomić dziesiątki lub setki podagentów równolegle w ramach jednej sesji. Każdy z nich pracuje nad swoim fragmentem problemu, a następnie wyniki są scalane. To może znacząco przyspieszyć duże projekty.

    Claude Managed Agents na AWS również zyskały rozszerzone wsparcie. W połączeniu z nowymi możliwościami webhooków i nadpisywania konfiguracji agenta na poziomie sesji, infrastruktura agentowa staje się bardziej dojrzała.

    Ceny i dostępność

    Anthropic utrzymuje ceny na poziomie Claude Opus 4.8 — 5 dolarów za milion tokenów wejściowych, 25 za wyjściowe. Tryb Fast Mode działa 2,5 razy szybciej przy koszcie 10 dolarów za wejście i 50 za wyjście, co jest trzykrotnie tańsze niż w poprzednich generacjach. Model jest dostępny przez API Claude, Amazon Bedrock, Google Cloud Vertex AI i Microsoft Foundry.

    Opus 4.8 to solidny krok w stronę autonomii. Mniej klikania, więcej zaufania do maszyny i realna oszczędność czasu przy złożonych zadaniach — to podsumowuje to wydanie.


    Źródła

  • Claude Opus 4.8 w praktyce: setki agentów, dynamiczne przepływy i taniej o dwie trzecie

    Claude Opus 4.8 w praktyce: setki agentów, dynamiczne przepływy i taniej o dwie trzecie

    Anthropic wprowadził Claude Opus 4.8, a wraz z nim aktualizację Claude Code, która umożliwia tworzenie dynamicznych przepływów pracy oraz orkiestrację do tysiąca równoległych podagentów w jednej sesji. Nowy model jest dostępny na claude.ai, w API oraz na Amazon Bedrock, a ceny za standardowe użycie pozostały takie same jak w poprzedniej wersji.

    Co nowego w skrócie

    • Claude Opus 4.8 radzi sobie z długimi zadaniami agentowymi, popełniając czterokrotnie mniej niewykrytych błędów niż jego poprzednik.
    • Dynamiczne przepływy pozwalają uruchomić do 1000 podagentów w ramach jednego zadania, z maksymalnie 16 działającymi jednocześnie.
    • Tryb szybki jest 2,5 raza szybszy i trzy razy tańszy niż w przypadku Claude Opus 4.7.
    • Sterowanie wysiłkiem jest teraz pod kontrolą użytkownika — komenda /effort pozwala wybrać poziom od niskiego do maksymalnego.

    Co potrafi Opus 4.8

    Nowy model jest zaprojektowany do zadań wymagających długotrwałej pracy agentowej, takich jak przeszukiwanie bazy kodu, koordynowanie wielu działań jednocześnie oraz samodzielne korygowanie błędów. Anthropic informuje, że Opus 4.8 jest około czterokrotnie mniej skłonny do pomijania błędów bez komentarza niż jego poprzednik. Model częściej przyznaje się do błędów, zamiast udawać, że wszystko jest w porządku.

    Okno kontekstowe wynosi milion tokenów, co pozwala modelowi analizować rozległy kod bez gubienia wątku. Dodatkowo obniżono minimalną długość promptu obsługiwaną przez cache — teraz wystarczy 1024 tokeny zamiast 2048, co zmniejsza koszty przy krótszych zapytaniach.

    Ceny pozostają na poziomie 5 dolarów za milion tokenów wejściowych i 25 za milion wyjściowych w standardowym trybie, co jest takie samo jak w Claude Opus 4.7. W trybie szybkim stawki wynoszą 10 i 50 dolarów, co jest trzykrotnie mniej niż 30 i 150 dolarów w poprzednich wersjach. To znaczący argument na rzecz korzystania z szybszych odpowiedzi.

    Dynamiczne przepływy — tu dzieje się najwięcej

    Dynamiczne przepływy — tu dzieje się najwięcej

    Najciekawszą nowością w Claude Code są dynamiczne przepływy pracy, które obecnie są dostępne w wersji beta. Claude Opus 4.8 działa jako orkiestrator, dzieląc złożone zadania na mniejsze części, które następnie rozsyła do dziesiątek lub setek podagentów, a później zbiera i weryfikuje wyniki.

    Architektura składa się z trzech warstw. Na górze znajduje się orkiestrator, którym zazwyczaj jest Opus 4.8, odpowiedzialny za dekompozycję zadania i końcową syntezę. Poniżej pracują podagenci, mogą to być lżejsze modele, takie jak Haiku lub Sonnet, jeśli koszty mają znaczenie. Na samym dole znajduje się warstwa narzędziowa, która zapewnia dostęp do plików, API, baz danych oraz wykonania kodu.

    Liczba podagentów nie jest ustalona na stałe. Model samodzielnie decyduje, ilu pracowników potrzebuje w trakcie realizacji zadania. Przy małym raporcie wystarczą trzy instancje, natomiast przy pełnej analizie konkurencji — kilkadziesiąt. Maksymalny limit wynosi tysiąc podagentów na sesję, z czego szesnaście może działać jednocześnie.

    Lepsza integracja z terminalem i nowe możliwości API

    Claude Code otrzymał również ulepszoną obsługę agentów działających w tle. Dotyczy to długotrwałych zadań inżynieryjnych, takich jak migracje kodu, refaktoryzacje i przeglądy repozytoriów, które teraz lepiej integrują się z terminalem i sesjami. Użytkownicy mogą uruchomić te zadania, a następnie wrócić po wyniki, bez obawy o ich przerwanie.

    W API Messages wprowadzono możliwość wstawiania wiadomości systemowych w trakcie konwersacji, po turze użytkownika. Dotychczas, aby zmienić zachowanie modelu w trakcie długiego zadania, konieczne było ponowne wysłanie całego promptu systemowego, co rozbijało cache. Teraz wystarczy dodać role: "system" bezpośrednio w tablicy wiadomości — to mała zmiana, ale istotna dla osób budujących złożone pipeline'y agentowe.

    Dodatkowo, funkcja /simplify, która służy do upraszczania kodu podczas przeglądów, została usprawniona, co powinno ucieszyć zespoły zajmujące się code review z asystą AI.

    Anthropic zaleca selektywne podejście do adopcji: trudne zadania agentowe i migracje warto przenieść na Opus 4.8, natomiast proste, jednorazowe generacje kodu mogą pozostać przy starszych modelach. Kluczowe są pełne specyfikacje i jasne instrukcje weryfikacji — model najlepiej wykorzystuje swoje możliwości, gdy dokładnie wie, co ma sprawdzić.


    Źródła