Tag: LLM

  • Cline 4.0.8 otwiera się na GCP Vertex — teraz wpiszesz własny model z palca

    Cline 4.0.8 otwiera się na GCP Vertex — teraz wpiszesz własny model z palca

    Cline w wersji 4.0.8 wprowadza istotne zmiany w integracji z Google Cloud Vertex AI, poszerzając ofertę o więcej gotowych modeli oraz wprowadzając możliwość ręcznego wpisywania identyfikatorów dla niestandardowych konfiguracji. Deweloperzy korzystający z Vertex mogą teraz łatwiej uzyskać dostęp do nowych modeli, regionalnych oraz wewnętrznych, bez konieczności czekania na aktualizację katalogu.

    Co nowego w integracji z Vertex AI

    • Rozszerzona lista modeli — w interfejsie Cline dostępnych jest więcej modeli hostowanych na platformie Vertex.
    • Swobodny wpis identyfikatora — nowa opcja w rozwijanym menu umożliwia ręczne podanie nazwy modelu, zamiast wyboru z gotowej listy.
    • Autoryzacja bez zmian — konfiguracja opiera się na koncie serwisowym lub domyślnych poświadczeniach aplikacji, z wymogiem aktywnego projektu GCP i włączonej usługi Vertex AI.
    • Przepustowość bez blokady — niestandardowe identyfikatory są przekazywane bez modyfikacji, co umożliwia natychmiastowe działanie modeli eksperymentalnych czy prywatnych wdrożeń.

    Dlaczego to ma znaczenie dla zespołów na GCP

    Vertex AI jest kluczowym elementem ekosystemu Google, oferującym zarządzanie dostępem i kontrolę na poziomie projektu. Cline od dawna wspiera Vertex jako jednego z dostawców modeli, ale wcześniej użytkownicy byli ograniczeni do listy modeli przygotowanej przez zespół Cline. To działało dobrze dla popularnych modeli, ale pojawiały się problemy, gdy nowe modele były dostępne w regionie, ale nie były jeszcze widoczne w interfejsie.

    Dzięki nowej opcji ręcznego wpisywania identyfikatora, można teraz łatwo skopiować identyfikator modelu z konsoli Google Cloud i wkleić go w ustawieniach Cline. Dla zespołów pracujących w złożonych środowiskach, gdzie dostępność modeli różni się między regionami i projektami, oznacza to koniec ręcznego dostosowywania konfiguracji.

    Szerszy obraz: mniej tarć, więcej elastyczności

    Cline od początku stawia na wielodostawczość. Umożliwia użytkownikom przełączanie się między różnymi modelami, takimi jak Claude, Gemini, modele z Vertex czy Deep Seek, bez przywiązywania się do jednego ekosystemu. Wprowadzenie opcji ręcznego wpisywania identyfikatorów dla Vertex to krok w stronę większej elastyczności, pozwalający użytkownikom na samodzielne wybieranie modeli, które najlepiej odpowiadają ich potrzebom.

    W notkach do przyszłych wydań Cline zaznaczono, że identyfikatory modeli Vertex przechodzą przez system bez ingerencji. Oznacza to, że nawet wewnętrzne wdrożenia fine-tuned modeli, przypisane do konkretnego projektu GCP, będą działać tak, jakby były natywnie wspierane. Wystarczy poprawna autoryzacja i aktywny endpoint.

    Jak to skonfigurować

    Proces konfiguracji pozostał bez zmian w porównaniu do wcześniejszych wersji. W ustawieniach Cline należy wybrać GCP Vertex AI jako dostawcę, a następnie podać identyfikator projektu oraz region. Uwierzytelnienie można zrealizować za pomocą klucza konta serwisowego lub domyślnych poświadczeń aplikacji. Różnica polega na tym, że zamiast wybierać z listy modeli, można teraz wpisać własną wartość, na przykład gemini-2.0-flash-exp lub identyfikator wewnętrznego modelu organizacji.

    To oznacza szybszy dostęp do testowych wersji modeli i łatwiejsze włączenie Cline w istniejące pipeline'y AI w firmach. Dla mniejszych zespołów developerskich to jedno kliknięcie mniej i mniej powodów do szukania obejść.

    Aktualizacja jest dostępna w głównym repozytorium Cline na GitHubie, a szczegóły techniczne można znaleźć w oficjalnych changelogach oraz dokumentacji providera w docs.cline.bot.


    Źródła

  • Claude Sonnet 5 z milionowym oknem kontekstu i odświeżonymi agentami

    Claude Sonnet 5 z milionowym oknem kontekstu i odświeżonymi agentami

    Anthropic wprowadził Claude Sonnet 5, nową wersję modelu z rodziny Sonnet, zaprojektowaną do zadań związanych z kodowaniem i agentami. Model działa z pełnym milionowym oknem kontekstu, domyślnie włączonym myśleniem adaptacyjnym oraz limitem wyjściowym wynoszącym 128 tysięcy tokenów. Firma wprowadziła również poprawki w zarządzanych agentach, które zmieniają sposób komunikacji aplikacji webowych i narzędzi deweloperskich z długo działającymi sesjami.

    Co nowego w skrócie

    • Claude Sonnet 5 oferuje domyślne okno kontekstu 1M tokenów
    • Myślenie adaptacyjne jest włączone automatycznie z domyślnym poziomem high; ręczne sterowanie myśleniem może nie działać jak w poprzednich wersjach
    • Zarządzani agenci otrzymali usprawnienia w strumieniowaniu sesji, paginacji i webhookach
    • Ceny – obecna standardowa cena to 2 dolary za milion tokenów wejściowych i 10 dolarów za milion wyjściowych
    • Konfiguracja agentów stała się elastyczniejsza dzięki nadpisywaniu ustawień i precyzyjniejszemu wstrzykiwaniu poświadczeń z vaultów

    Milion tokenów bez kombinowania

    Największą zmianą dla programistów pracujących z Claude Code jest uproszczenie zarządzania kontekstem. W poprzednich wersjach użytkownicy musieli wybierać między wariantem 200K a 1M. Sonnet 5 zawsze działa z pełnym oknem, a sesje automatycznie się kompaktują, zanim zapełnią przestrzeń (domyślnie przy około 967 tysiącach tokenów).

    Próg wyjściowy 128K tokenów również ma znaczenie. Oznacza to, że model może wygenerować długi blok kodu lub dokumentacji w jednym przebiegu, bez przerywania i łączenia fragmentów. Dla zespołów pracujących z dużymi bazami kodu to oszczędność czasu i zmniejszenie ryzyka błędów przy scalaniu odpowiedzi.

    Jednakże, jeśli chodzi o sterowanie próbkowaniem (temperature, top_p, top_k) z niestandardowymi wartościami, użytkownicy mogą napotkać błąd 400 na ścieżkach migracyjnych opisanych w dokumentacji. Jeśli pipeline opiera się na precyzyjnym dostrajaniu tych parametrów, konieczne będzie dostosowanie go do nowych reguł.

    Myślenie adaptacyjne jako standard

    Myślenie adaptacyjne jako standard

    Anthropic uprościł również proces rozumowania. Ręczne rozszerzone myślenie, znane z wcześniejszych modeli jako thinking: {type: "enabled", budget_tokens: N}, może nie być obsługiwane w dotychczasowej formie. Zastępuje je myślenie adaptacyjne, które jest kontrolowane parametrem effort.

    Domyślny poziom to high. Interesujące jest to, że Sonnet 5 na medium osiąga poziom inteligencji Claude Sonnet 5 na high, a na high – czwórki na max. Dzięki temu nawet przy niższych ustawieniach użytkownicy otrzymują dobrą jakość przy mniejszym zużyciu tokenów.

    Należy jednak uważać z ustawieniami low i medium – model trzyma się ściśle zakresu zadania i nie wykonuje nic ponad to. W przypadku umiarkowanie złożonych problemów może to prowadzić do płytkiego rozumowania. W takich sytuacjach lepiej zwiększyć effort niż walczyć z promptowaniem.

    Agenci, którzy reagują na zdarzenia

    Agenci, którzy reagują na zdarzenia

    Równolegle z modelem Anthropic zaktualizował infrastrukturę zarządzanych agentów. Najważniejsza zmiana to delty zdarzeń w strumieniach sesji. Zamiast co kilka sekund sprawdzać status, interfejs może teraz nasłuchiwać przyrostowych aktualizacji. Dla dashboardów i asystentów kodowania to różnica między interfejsem, który działa w czasie rzeczywistym, a takim, który wydaje się opóźniony.

    Dodatkowo wprowadzono wsteczną paginację przy listowaniu sesji. Przeglądanie historii nie kończy się już na najnowszych wpisach – można cofać się kursorami prev_page, co jest przydatne w widokach audytowych i przy debugowaniu długo działających agentów.

    • Webhooki również zyskały nowe zdarzenia związane z cyklem życia agenta. Systemy integracyjne mogą teraz reagować natychmiast, bez potrzeby pollingu. Mechanizm przechowywania poświadczeń, czyli vaulty, obsługuje teraz parametr injection_location, który pozwala określić, czy dane uwierzytelniające trafiają do nagłówków, body czy obu tych miejsc przy wyjściu.

    Co to znaczy w codziennej pracy

    Przykładowy scenariusz: aplikacja webowa korzystająca z agenta do analizy zgłoszeń błędów. Przy starym API konieczne było cykliczne odpytywanie o status sesji, aby odświeżyć interfejs. Teraz strumień sam informuje o postępach – to oznacza mniej kodu po stronie frontendu i mniejsze obciążenie serwera.

    Elastyczne nadpisywanie konfiguracji agenta ułatwia również pracę. Zamiast tworzyć kilka sztywnych definicji agenta dla różnych scenariuszy, można mieć jedną bazową i dostosowywać ją parametrami przy starcie sesji. To zmniejsza liczbę konfiguracji do zarządzania i ryzyko niezgodności wersji.

    Wstrzykiwanie poświadczeń z vaultów na poziomie nagłówków lub body zwiększa bezpieczeństwo. W środowiskach, gdzie agent łączy się z zewnętrznymi API, można teraz precyzyjniej kontrolować, gdzie trafiają wrażliwe dane, eliminując ryzyko, że klucz API wyląduje w niewłaściwym miejscu.


    Źródła

  • Claude Sonnet 5: Większe okno kontekstowe, adaptacyjne myślenie i nowe zasady dla programistów

    Claude Sonnet 5: Większe okno kontekstowe, adaptacyjne myślenie i nowe zasady dla programistów

    Anthropic udostępnił 30 czerwca 2026 roku Claude Sonnet 5, najnowszą wersję modelu z serii Sonnet. Model ten oferuje domyślnie okno kontekstowe o rozmiarze miliona tokenów oraz maksymalnie 128 tysięcy tokenów na wyjściu. Stał się on domyślną jednostką w planach Free i Pro, a także został wprowadzony do API, platform chmurowych oraz planów korporacyjnych. Przy premierze wprowadzono ceny w wysokości 2 dolarów za milion tokenów wejściowych i 10 dolarów za milion tokenów wyjściowych, które od 10 sierpnia 2026 roku stały się cenami standardowymi.

    Co warto zapamiętać

    • Claude Sonnet 5 debiutuje z oknem kontekstowym 1M tokenów i wyjściem do 128K tokenów
    • Adaptacyjne myślenie włączone domyślnie zastępuje ręczne zarządzanie budżetem rozumowania
    • Ceny wprowadzające wynoszą 2 USD/1M tokenów wejścia i 10 USD/1M tokenów wyjścia – od 10 sierpnia 2026 roku są to ceny standardowe
    • Nowe zasady próbkowania – parametry takie jak temperature, top_p i top_k wymagają uwagi przy migracji z niestandardowych ustawień
    • Dostępność obejmuje API Anthropic oraz platformy chmurowe

    Adaptacyjne myślenie zamiast ręcznego budżetowania

    Największa zmiana w Claude Sonnet 5 dotyczy mechanizmu rozumowania. Model korzysta z trybu adaptacyjnego myślenia, co oznacza, że sam decyduje, ile czasu poświęcić na analizę problemu. Programiści migrujący aplikacje powinni usunąć niektóre parametry związane z ręcznym budżetowaniem rozumowania, ponieważ ich pominięcie jest akceptowane.

    Dla integracji, które nie konfigurowały jawnie parametrów rozumowania, zmiana będzie praktycznie niewidoczna – model działa z włączonym myśleniem adaptacyjnym. Jednak zespoły, które precyzyjnie dostrajały budżety rozumowania, muszą teraz przeprojektować logikę. Anthropic zaleca traktowanie migracji jako „drop-in upgrade”, ale dokumentacja ostrzega przed zmianami w kontroli próbkowania i usunięciem ręcznego extended thinking.

    Próbkowanie po nowemu – uwaga na temperature i top_p

    Kolejna pułapka migracyjna dotyczy parametrów próbkowania. W ścieżce migracyjnej dla Claude Sonnet 5 parametry takie jak temperature, top_p i top_k należy usunąć tylko wtedy, gdy wcześniej korzystano z wartości innych niż domyślne – ich pominięcie jest akceptowane. Anthropic sugeruje dokładne sprawdzenie integracji przed wdrożeniem produkcyjnym, ponieważ nieprzemyślane przejście może prowadzić do błędów w żądaniach.

    Dla zespołów devopsowych i backendowych, które utrzymują złożone potoki agentowe, oznacza to dodatkowy etap testów, zwłaszcza tam, gdzie temperatura była regulowana dynamicznie w zależności od etapu zadania. Warto również zwrócić uwagę na interakcję nowych reguł próbkowania z adaptacyjnym trybem myślenia – model może działać inaczej przy tych samych ustawieniach, które były skuteczne w poprzednich wersjach.

    Większy kontekst, niższy koszt – co to zmienia dla programistów

    Okno kontekstowe miliona tokenów oraz wyjście do 128 tysięcy tokenów to zmiana, którą odczują osoby pracujące z dużymi bazami kodu lub złożonymi agentami. Można teraz przesłać całą dokumentację projektu, historię zmian i testy w jednym żądaniu, bez dzielenia na fragmenty i bez utraty kontekstu między zapytaniami.

    Ceny wprowadzające są zauważalnie niższe niż w przypadku modeli klasy Opus. Dla zespołów korzystających z vibe codingu lub zautomatyzowanych przeglądów kodu oznacza to realną oszczędność przy wyższej wydajności. W testach porównawczych Claude Sonnet 5 wypada blisko Opusa w zadaniach związanych z kodowaniem, użyciem narzędzi i pracą z wiedzą, ale kosztuje wyraźnie mniej.

    Platformy chmurowe, takie jak Amazon Bedrock, Google Cloud i Microsoft Foundry, również udostępniają model. Dla zespołów korporacyjnych to szansa na szybkie testy bez zmiany dostawcy infrastruktury. Anthropic planuje, aby Claude Sonnet 5 nie tylko zastępował poprzednie wersje Sonnet, ale także przejmował część zadań, do których wcześniej potrzebny był Opus.

    Wnioski dla zespołów technicznych

    Claude Sonnet 5 to więcej niż przyrostowa aktualizacja. Zmiana trybu rozumowania na adaptacyjny, zaostrzone reguły próbkowania oraz rozszerzone limity kontekstu tworzą nowy punkt wyjścia dla agentów i zautomatyzowanych pipeline'ów. Zespoły, które planują migrację, powinny zacząć od audytu parametrów próbkowania i logiki zarządzania rozumowaniem, zwłaszcza tam, gdzie wcześniej polegano na ręcznym extended thinking. Okno promocyjnych cen do 10 sierpnia 2026 roku daje czas na testy, ale warto działać szybko, ponieważ zmiany w architekturze modelu są większe niż zwykle przy tego typu aktualizacjach.


    Źródła

  • Claude Code wprowadza domyślnie Claude Sonnet 5 – potężny model z 1M oknem kontekstu za 2 dolary

    Claude Code wprowadza domyślnie Claude Sonnet 5 – potężny model z 1M oknem kontekstu za 2 dolary

    Anthropic wprowadził aktualizację Claude Code 2.1.197, w której domyślnym modelem asystenta kodowania stał się Claude Sonnet 5. To znacząca zmiana dla zespołów pracujących z dużymi bazami kodu, ponieważ nowy model oferuje natywne okno kontekstu mieszczące milion tokenów. Promocyjna wycena API obowiązuje do końca sierpnia 2026 roku. Aktualizacja została wprowadzona 30 czerwca 2026 roku i jest dostępna dla wszystkich użytkowników narzędzia.

    Co nowego w skrócie

    • Claude Sonnet 5 jest teraz domyślnym modelem w Claude Code, zastępując wcześniejszą wersję.
    • Natywne okno kontekstu 1M tokenów umożliwia analizowanie całych repozytoriów, wieloplikowe refaktoryzacje oraz złożone debugowanie w jednej sesji.
    • Ceny promocyjne wynoszą 2 USD za milion tokenów wejściowych i 10 USD za milion wyjściowych, obowiązujące do 31 sierpnia 2026.
    • Aktualizacja do wersji 2.1.197 jest wymagana, aby skorzystać z nowego modelu.

    Skok w agentowym kodowaniu

    Sonnet 5 to najbardziej zaawansowany model w linii Sonnet. W testach osiąga wyniki bliskie poziomowi Opus, ale przy znacznie niższych kosztach. Oznacza to, że model samodzielnie planuje działania, korzysta z narzędzi takich jak przeglądarki, terminale i edytory, oraz realizuje wieloetapowe zadania bez ciągłego nadzoru. W przeciwieństwie do wcześniejszych wersji Sonnetów, które często kończyły pracę w połowie, „piątka” doprowadza zadania do końca. Sprawdza również własne wyniki z własnej inicjatywy, bez potrzeby dodatkowych promptów o weryfikację.

    Dla web developerów to istotna zmiana. Milion tokenów kontekstu wystarcza, aby objąć duże fragmenty projektu, prześledzić zależności między modułami i przeprowadzić refaktoryzację bez gubienia wątku. Modele z mniejszym oknem często tracą szerszy obraz, gdy sesja się przeciąga — ten problem w Sonnet 5 został rozwiązany.

    Co to oznacza dla zespołów DevOps i CI

    Promocyjna wycena API jest szczególnie ważna dla automatyzacji. Zespoły, które integrują Claude Code w pipeline'y CI/CD lub używają go do masowej analizy kodu, mogą przetestować nowy model przy relatywnie niskich kosztach. Należy jednak pamiętać, że cena 2/10 USD za milion tokenów to oferta limitowana — po 31 sierpnia wróci standardowy cennik. Warto zaplanować większe zadania tak, aby zmieścić się w tym okresie.

    Jeśli twój zespół korzysta z Claude Code przez API, sprawdź wersję klienta. Bez aktualizacji do 2.1.197 model Sonnet 5 nie będzie dostępny, nawet jeśli konto ma odpowiednie uprawnienia. Anthropic wyłączył również ręczne rozszerzone myślenie — parametr thinking: {type: "enabled", budget_tokens: N} został usunięty po deprecjacji. Zamiast tego model korzysta z adaptacyjnego myślenia, regulowanego parametrem effort.

    Migracja bez większych niespodzianek

    Dla zespołów przechodzących z poprzednich wersji, Anthropic zaleca dostosowanie poziomu effort zamiast przenoszenia ustawień jeden do jednego. Sonnet 5 na poziomie medium dorównuje możliwościami poprzednim wersjom na high. Jeśli potrzebujesz maksymalnej mocy, zwiększ effort na xhigh — to zalecane ustawienie do najtrudniejszych zadań programistycznych.

    Model domyślnie kalibruje długość odpowiedzi do złożoności zadania. Na proste pytania odpowie krócej niż poprzednik, podczas analizy rozbudowanego kodu rozwinie się bardziej. Jeśli twój interfejs oczekuje konkretnej formy odpowiedzi, może być potrzebne dostrojenie promptów.

    Aktualizacja do wersji 2.1.197 nie wymaga dodatkowych uprawnień — wystarczy standardowa procedura aktualizacji w menedżerze pakietów lub bezpośrednio przez CLI. Nowy model działa jako domyślny od razu po restarcie narzędzia.

    Podsumowanie

    Zmiana domyślnego modelu na Sonnet 5 to istotna aktualizacja. Milion tokenów kontekstu, wyższa agentyczność i niższe ceny w porównaniu do Opus wprowadzają realne zmiany w pracy z kodem. Jest to szczególnie istotne dla zespołów, które miały trudności z ograniczeniami okna kontekstu przy analizie dużych repozytoriów. Wersja 2.1.197 jest już dostępna, a promocyjne stawki API obowiązują tylko do końca sierpnia.


    Źródła

  • Anthropic ujednolica limity API i upraszcza strukturę tierów w platformie Claude

    Anthropic ujednolica limity API i upraszcza strukturę tierów w platformie Claude

    Firma Anthropic ogłosiła zmiany w zasadach korzystania z API Claude. Modele Sonnet i Haiku otrzymały teraz takie same limity szybkości jak Claude Opus na wszystkich poziomach użytkowania. Platforma została zreorganizowana, konsolidując dotychczasową strukturę w trzy czytelne tiery: Start, Build i Scale. Dla większości zespołów oznacza to automatyczne przeniesienie do wyższego poziomu bez konieczności podejmowania jakichkolwiek działań.

    Kluczowe informacje o aktualizacji

    • Limity API dla Claude Sonnet i Haiku są teraz równe limitom Claude Opus na każdym tierze
    • Trzy tiery – Start, Build i Scale – zastępują wcześniejszy, bardziej rozdrobniony system
    • Automatyczna migracja – większość organizacji zostanie przeniesiona do wyższego tieru bez dodatkowych formalności
    • Limity organizacyjne – ustalane są na poziomie całej organizacji, a nie pojedynczych użytkowników
    • Maksymalny miesięczny wydatek dla tieru Scale wynosi 200 000 dolarów

    Co konkretnie zmieniło się w limitach?

    Dotychczas korzystanie z różnych modeli Claude oznaczało różne limity – Opus miał własne pułapy, Sonnet inne, a Haiku jeszcze inne. Teraz to się zmienia. Anthropic postawiło na spójność: niezależnie od tego, czy aplikacja wywołuje Claude Sonnet do generowania kodu, czy Haiku do lżejszych zadań, limit żądań na minutę (RPM) oraz tokenów wejściowych i wyjściowych jest identyczny.

    W tierze Start limit wynosi około 1000 RPM, 2 miliony tokenów wejściowych na minutę i 400 tysięcy tokenów wyjściowych. Build podnosi te wartości do 5000 RPM, 5 milionów tokenów wejściowych i miliona wyjściowych. Scale, przeznaczony dla największych wdrożeń produkcyjnych, oferuje 10 000 RPM, 10 milionów tokenów wejściowych i 2 miliony wyjściowych przy wspomnianym limicie wydatków 200 000 dolarów miesięcznie. Warto jednak sprawdzać aktualne liczby bezpośrednio w dokumentacji – Anthropic zastrzega, że wartości mogą być aktualizowane.

    Dlaczego to ma znaczenie dla zespołów deweloperskich?

    Ujednolicenie limitów upraszcza planowanie wydajnościowe. Zespoły budujące aplikacje oparte na wielu modelach Claude – na przykład systemy agentowe, gdzie jeden model planuje zadania, a drugi wykonuje generowanie kodu – nie muszą już osobno kalkulować przepustowości dla każdego endpointu. Jedna polityka limitów obejmuje teraz całą organizację.

    Szczególnie odczują to środowiska o wysokiej przepustowości: potoki DevOps, backendowa automatyzacja czy narzędzia do generowania kodu w czasie rzeczywistym. Wcześniej różnice między modelami mogły wymuszać ograniczenia w architekturze – teraz można skalować równomiernie. Automatyczne przeniesienie większości organizacji do wyższego tieru dodatkowo zmniejsza tarcia przy rozwoju produktu.

    Trzy tiery – przejrzystość zamiast złożoności

    Konsolidacja do trzech poziomów to krok w stronę prostoty. Zamiast rozbudowanej struktury, którą trudno było wytłumaczyć nowym członkom zespołu, mamy logiczną ścieżkę: Start dla projektów na wczesnym etapie i małych integracji, Build dla rozwijających się aplikacji, oraz Scale dla dużych wdrożeń korporacyjnych.

    Limity działają teraz na poziomie organizacji. To rozwiązanie eliminuje sytuacje, w których jeden intensywnie korzystający z API deweloper blokuje dostęp pozostałym. Administratorzy zyskują lepszą kontrolę nad budżetem – miesięczny pułap wydatków w tierze Scale jest jasno określony i wynosi 200 000 dolarów, co pozwala precyzyjnie planować koszty przy dużych wdrożeniach.

    Praktyczne następstwa w świecie web devu i AI

    Dla branży web developmentu i systemów AI zmiany te wpisują się w szerszy trend upraszczania infrastruktury modeli językowych. Twórcy narzędzi takich jak Cursor, Windsurf czy Claude Code, które intensywnie wykorzystują API Claude do generowania i analizy kodu, zyskują bardziej przewidywalne środowisko. Mniej czasu spędzonego na zarządzaniu limitami to więcej czasu na rozwój funkcjonalności. Automatyczna migracja oznacza też, że zespoły nie muszą przerywać pracy, aby dostosować się do nowych zasad – wszystko dzieje się po stronie platformy.


    Źródła

  • Claude Opus 4.8 wchodzi z milionowym oknem kontekstu i nowym narzędziem advisor

    Claude Opus 4.8 wchodzi z milionowym oknem kontekstu i nowym narzędziem advisor

    28 maja 2026 roku Anthropic wprowadziło Claude Opus 4.8, model, który oferuje 1 milion tokenów okna kontekstowego, 128 tysięcy tokenów wyjściowych oraz przeprojektowane myślenie adaptacyjne. Platforma zyskała również rozszerzone wsparcie dla zarządzanych agentów na AWS, możliwość wstrzykiwania wiadomości systemowych w trakcie konwersacji oraz parametr max_tokens w narzędziu advisor, co pozwala deweloperom lepiej kontrolować koszty i opóźnienia.

    Co nowego – w pigułce

    • Claude Opus 4.8 debiutuje 41 dni po premierze poprzedniej wersji, z 4-krotnie mniejszym ryzykiem przeoczenia błędów w kodzie.
    • Nowy parametr max_tokens w narzędziu advisor pozwala ograniczać zużycie zasobów przy zadawaniu pytań modelowi.
    • Wiadomości systemowe w trakcie konwersacji umożliwiają aktualizację promptów systemowych bez resetowania konwersacji.
    • Claude Managed Agents są dostępne na AWS, a ulepszone raportowanie odmów wspiera debugowanie aplikacji.
    • Dynamic Workflows w Claude Code mogą uruchomić do 1000 równoległych podagentów do migracji repozytoriów.

    Myślenie adaptacyjne i uczciwość – co się zmieniło

    Claude Opus 4.8 wprowadza mechanizm dynamicznego dostosowywania głębi wnioskowania. Model samodzielnie ocenia, ile "myślenia" wymaga konkretne zadanie – przy prostych pytaniach przechodzi do odpowiedzi szybciej, a przy bardziej złożonych angażuje więcej zasobów. Wczesne testy pokazują, że model rzadziej przeocza błędy w kodzie, co czyni go bardziej wiarygodnym narzędziem dla zespołów DevOps i web developerów. Model częściej sygnalizuje, gdy nie ma pewności, co jest istotne w kontekście produkcji.

    Narzędzie advisor z kontrolą kosztów

    Nowy parametr max_tokens w narzędziu advisor odpowiada na problem rosnących kosztów przy intensywnym korzystaniu z modelu. Umożliwia on ustawienie limitu tokenów dla odpowiedzi generowanych przez advisor, co wpływa na przewidywalność wydatków i czas odpowiedzi. Deweloperzy mogą teraz lepiej zarządzać budżetem zapytań, nie rezygnując z jakości.

    Claude Managed Agents i komunikaty systemowe w środku rozmowy

    Platforma rozszerza wsparcie dla Claude Managed Agents na AWS, co upraszcza wdrażanie agentów w chmurze Amazonu. Zmiana w API Messages pozwala teraz na wprowadzanie wpisów systemowych bezpośrednio w tablicy messages, co umożliwia modyfikację kontekstu modelu w trakcie rozmowy. To rozwiązanie jest przydatne w długich interakcjach, gdzie wymagania ewoluują.

    Ulepszono także raportowanie odmów. Gdy model odrzuca żądanie, odpowiedź zawiera więcej szczegółów dotyczących przyczyny. To pozwala zespołom budującym krytyczne aplikacje szybciej zidentyfikować źródło problemu.

    Ceny i tryb Fast Mode

    Anthropic utrzymało standardowe ceny na poziomie Claude Opus 4.8: 5 dolarów za milion tokenów wejściowych i 25 dolarów za milion wyjściowych. Fast Mode kosztuje 10 i 50 dolarów odpowiednio, ale działa około 2,5 razy szybciej niż tryb standardowy. W porównaniu z Fast Mode poprzedniej generacji (30/150 dolarów) to trzykrotna obniżka, co ma znaczenie w kontekście budżetu przy wysokoprzepustowych zadaniach agentowych.

    Co to znaczy dla web developmentu

    Claude Opus 4.8 stał się domyślnym modelem dla planów Pro, Max, Team i Enterprise w Claude Code. Milionowe okno kontekstu umożliwia analizę całych repozytoriów w jednym przebiegu, a Dynamic Workflows, dostępne jako podgląd badawczy, potrafią zrównoleglić zadania migracyjne na dużą skalę. Dzięki kontroli kosztów przez max_tokens w advisorze oraz możliwości podmiany promptów systemowych w locie, zyskujemy narzędzia gotowe do zastosowania w produkcji.


    Źródła

  • Claude Opus 4.8 wchodzi do gry: adaptacyjne myślenie i milion tokenów kontekstu na pokładzie

    Claude Opus 4.8 wchodzi do gry: adaptacyjne myślenie i milion tokenów kontekstu na pokładzie

    Anthropic wypuścił 28 maja 2026 roku Claude Opus 4.8, który jest najnowszym modelem w swojej serii. Został zaprojektowany do wykonywania autonomicznych zadań agentowych, złożonego kodowania oraz pracy z wiedzą profesjonalną. Model oferuje domyślnie okno kontekstowe o wielkości miliona tokenów i rezygnuje z ręcznego przełącznika extended thinking na rzecz w pełni adaptacyjnego podejścia do głębokości rozumowania.

    Co nowego w pigułce

    • Adaptive Thinking zastępuje dotychczasowy mechanizm extended thinking — model sam decyduje, jak głęboko analizować problem.
    • Okno kontekstowe 1M tokenów dostępne domyślnie, z maksymalną długością wyjściową 128 tysięcy tokenów.
    • Wydajność w kodowaniu wzrasta do 88,6% na SWE-bench Verified, a model czterokrotnie rzadziej przeocza błędy w kodzie.
    • Dynamic Workflows w Claude Code umożliwia natywną koordynację dziesiątek, a nawet setek równoległych podagentów.
    • Ceny bez zmian względem Claude Opus 4.8 — 5 dolarów za milion tokenów wejściowych i 25 za wyjściowe, z opcjonalnym trybem Fast Mode.

    Nie chodzi już o gadanie — to maszyna do długich zadań

    Opus 4.8 to nie tylko odświeżenie. Anthropic przesuwa akcent z "modelu językowego" na "agenta produkcyjnego". W benchmarkach widać to wyraźnie: SWE-bench Verified na poziomie 88,6% to znaczący postęp, który czyni ten model realnym współpracownikiem programisty. Wersja Pro tego samego testu osiąga wzrost o 4,9 punktu procentowego — do 69,2%.

    Model jako pierwszy w chmurze osiąga zero procent zgłaszania błędnych wyników bez ich krytycznej oceny. Jeśli coś jest nie tak, Opus 4.8 sam to wyłapie i zakomunikuje, zamiast udawać, że wszystko jest w porządku. To podejście do kwestii zaufania w narzędziach agentowych jest istotne.

    Największą różnicę czuć w przepływie pracy. Model radzi sobie z zadaniami wieloetapowymi, gdzie wykonanie kodu przeplata się z analizą wyników i korektą strategii. Użytkownik nie musi go prowadzić — model dostaje cel, rozkłada go na części, wykonuje i sprawdza efekty.

    Adaptive Thinking i kontrola wysiłku

    Adaptive Thinking i kontrola wysiłku

    Brak osobnego przełącznika extended thinking to nie tylko kosmetyka. Adaptive Thinking oznacza, że model sam decyduje, kiedy warto pomyśleć dłużej, a kiedy odpowiedź jest oczywista. Użytkownicy claude.ai mają dodatkowo selektor wysiłku, co pozwala im kontrolować, ile "energii" obliczeniowej model poświęca na dane zadanie.

    To podejście ma sens. Nie każdy prompt wymaga głębokiej analizy, a płacenie za zbędne tokeny w prostych zapytaniach mogło być frustrujące. Teraz model decyduje, a użytkownik może dostosować intensywność.

    Opus 4.8 obsługuje ponad 80 języków i był trenowany na danych do stycznia 2026 roku. Kontekst miliona tokenów w połączeniu z adaptacyjnym myśleniem sprawia, że narzędzie dobrze radzi sobie w analizie obszernych repozytoriów czy dokumentacji.

    Nowości w API i Claude Code

    Nowości w API i Claude Code

    Równolegle z modelem Anthropic wprowadza kilka istotnych zmian platformowych. Pojawiły się wiadomości systemowe w trakcie konwersacji, co jest przydatne, gdy trzeba dynamicznie zmienić zachowanie modelu bez resetowania całego kontekstu. Rozszerzono również kategorie odrzuceń w Messages API, co daje większą kontrolę nad tym, kiedy i dlaczego asystent odmawia odpowiedzi.

    Dla zespołów DevOps kluczową nowością są Dynamic Workflows w Claude Code. Mechanizm ten pozwala uruchomić dziesiątki lub setki podagentów równolegle w ramach jednej sesji. Każdy z nich pracuje nad swoim fragmentem problemu, a następnie wyniki są scalane. To może znacząco przyspieszyć duże projekty.

    Claude Managed Agents na AWS również zyskały rozszerzone wsparcie. W połączeniu z nowymi możliwościami webhooków i nadpisywania konfiguracji agenta na poziomie sesji, infrastruktura agentowa staje się bardziej dojrzała.

    Ceny i dostępność

    Anthropic utrzymuje ceny na poziomie Claude Opus 4.8 — 5 dolarów za milion tokenów wejściowych, 25 za wyjściowe. Tryb Fast Mode działa 2,5 razy szybciej przy koszcie 10 dolarów za wejście i 50 za wyjście, co jest trzykrotnie tańsze niż w poprzednich generacjach. Model jest dostępny przez API Claude, Amazon Bedrock, Google Cloud Vertex AI i Microsoft Foundry.

    Opus 4.8 to solidny krok w stronę autonomii. Mniej klikania, więcej zaufania do maszyny i realna oszczędność czasu przy złożonych zadaniach — to podsumowuje to wydanie.


    Źródła

  • Claude Opus 4.8 wchodzi do gry z oknem 1M tokenów i sterowaniem głębokością myślenia

    Claude Opus 4.8 wchodzi do gry z oknem 1M tokenów i sterowaniem głębokością myślenia

    Anthropic wprowadził 28 maja 2026 roku Claude Opus 4.8, który jest ich najnowszym modelem. Nowością jest zwiększone okno kontekstowe do miliona tokenów oraz maksymalny output wynoszący 128 tysięcy tokenów, a ceny pozostały na poziomie z poprzedniej wersji. To aktualizacja, która wprowadza znaczące zmiany pod maską.

    Co nowego w pigułce

    • Okno kontekstowe 1M tokenów i maksymalny output 128k – dostępne domyślnie w API, na Bedrocku, Google Cloud i Microsoft Foundry
    • Sterowanie wysiłkiem zamiast automatycznego myślenia adaptacyjnego – możliwość wyboru poziomu od niskiego do maksymalnego
    • Komunikaty systemowe w trakcie konwersacji – zmiana instrukcji bez przerywania cache promptów
    • 4x mniejsza szansa, że model pozostawi błąd w kodzie bez komentarza
    • Dynamic workflows w Claude Code – setki równoległych pod-agentów w jednej sesji

    Mid-conversation system messages, czyli koniec z rozbijaniem promptów

    Jedna z istotnych zmian, która na pierwszy rzut oka może wydawać się technicznym szczegółem, w praktyce oszczędza czas i nerwy. Wcześniej, aby zmienić system prompt w trakcie zadania, konieczne było rozpoczęcie nowego user turn lub czyszczenie cache. Teraz Messages API przyjmuje system entries bezpośrednio w tablicy wiadomości. Deweloperzy mogą zmieniać zasady w locie, bez restartowania kontekstu i dodatkowych kosztów.

    W długich sesjach agentowych to nie tylko udogodnienie, ale konkretna oszczędność. W przypadku wieloetapowego zadania, gdzie po piątym kroku chcesz zawęzić zakres odpowiedzi lub dodać nowe ograniczenie, wcześniej wymagało to skomplikowanego prompt engineeringu. Teraz wystarczy wprowadzić nową instrukcję i kontynuować.

    Effort control – sam decydujesz, ile model ma myśleć

    Anthropic zrezygnował z automatycznego „adaptive thinking” na rzecz jawnego sterowania wysiłkiem. Obok wyboru modelu pojawił się suwak, który pozwala ustawić poziom od niskiego do maksymalnego. Niski wysiłek skutkuje krótszymi czasami odpowiedzi i mniejszym zużyciem limitów, podczas gdy wysoki wysiłek uruchamia głębsze, częstsze przejścia przez łańcuch rozumowania.

    To rozwiązanie jest korzystne dla zespołów, które muszą balansować między szybkością a dokładnością. Nie zawsze potrzebujesz modelu, który analizuje każdy szczegół przez dłuższy czas. Czasem chcesz natychmiastowej odpowiedzi, a czasem bardziej szczegółowej analizy – teraz masz kontrolę nad tym bez zmiany modelu.

    Uczciwość jako funkcja, nie przypadek

    W testach Claude Opus 4.8 wypada około cztery razy lepiej niż jego poprzednik, jeśli chodzi o zostawianie błędów w kodzie bez oznaczenia ich. To istotna metryka dla zespołów dev ops i vibe coding.

    Model częściej sygnalizuje niepewność i rzadziej generuje odpowiedzi, które brzmią pewnie, ale nie są oparte na faktach. API wprowadziło także obiekt stop_details, który wyjaśnia kategorie odmowy, gdy request zostanie odrzucony. Teraz wiesz dokładnie, dlaczego model nie odpowiedział – czy to z powodu bezpieczeństwa, praw autorskich, czy innych przyczyn.

    Claude Code i agentowe plany wieloetapowe

    Nowe funkcje w research preview dla Claude Code to prawdopodobnie najbardziej praktyczny element tej aktualizacji. Model potrafi teraz planować pracę i uruchamiać setki równoległych pod-agentów w jednej sesji. Każdy z nich może działać dłużej, bez potrzeby ciągłego pytania użytkownika o zgodę na kolejny krok.

    W benchmarku „Mind to Web” Claude Opus 4.8 uzyskał 84% – to znaczący postęp w porównaniu do poprzedniej wersji i wynik lepszy niż GPT-5.5. Model sprawdza się szczególnie w długich zadaniach programistycznych, gdzie ważne jest utrzymanie kontekstu przez wiele kroków. GPT-5.5 ma przewagę w terminal coding, ale w przeglądarkowych agentach i wielowątkowych migracjach kodu nowy Claude Opus 4.8 wypada lepiej.

    Fast Mode również został ulepszony – jest 2,5 razy szybszy i trzykrotnie tańszy niż wcześniej (10 i 50 dolarów za milion tokenów input/output). W standardowym trybie ceny pozostały na poziomie 5 i 25 dolarów za milion tokenów.

    Co to oznacza dla zespołów technicznych

    Claude Opus 4.8 jest skierowany do przedsiębiorstw, które potrzebują złożonych workflows agentowych, analiz finansowych, cyberbezpieczeństwa i długich zadań programistycznych. Połączenie jawnego sterowania wysiłkiem z sygnalizowaniem niepewności ma znaczenie tam, gdzie koszt błędu jest wysoki.

    Dla zespołów dev ops nowa wersja Claude Code z dynamicznymi workflows może znacznie skrócić czas dużych migracji kodu. Zamiast ręcznie dzielić zadanie na mniejsze części, można powierzyć modelowi zaplanowanie wykonania z setkami pod-agentów. To już nie tylko asystent, ale koordynator. Jeśli do tej pory korzystałeś z GPT-5.5 ze względu na terminal coding, warto przetestować Claude Opus 4.8 w zadaniach przeglądarkowych i długodystansowych – tam przewaga Anthropica jest teraz wyraźna.


    Źródła

  • Factory v0.123.0 wprowadza stałe śledzenie tokenów i szybsze przesyłanie wiadomości

    Factory v0.123.0 wprowadza stałe śledzenie tokenów i szybsze przesyłanie wiadomości

    Twórcy platformy Factory ogłosili wydanie wersji v0.123.0, która została udostępniona użytkownikom pod koniec czerwca. Najważniejszą nowością w tej wersji jest moduł do stałego monitorowania zużycia tokenów, który jest teraz dostępny w panelu Mission Control. Dodatkowo zespół wprowadził mechanizm optymistycznego przesyłania wiadomości, mający na celu skrócenie czasu oczekiwania na odpowiedzi agentów AI. Krótko po premierze, 11 maja, opublikowano także łatkę v0.123.0, która zawierała drobne usprawnienia.

    Kluczowe informacje o aktualizacji

    • Śledzenie zużycia tokenów w Mission Control umożliwia bieżącą kontrolę kosztów i obciążenia workflow.
    • Optymistyczne przesyłanie wiadomości pozwala na szybszą interakcję z agentami przed pełnym nawiązaniem połączenia.
    • Powiadomienia o przestarzałych modelach informują programistów, które wersje warto zaktualizować.
    • Poprawki błędów sesji eliminują problemy z ładowaniem i zwiększają niezawodność pracy z subagentami.
    • Korekta zliczania tokenów subagentów dostarcza dokładniejsze dane do rozliczeń i analiz.

    Jak działa nowe śledzenie tokenów w Factory

    Dotychczas użytkownicy Factory mogli jedynie szacować zużycie tokenów na podstawie zewnętrznych narzędzi lub ogólnych metryk. Teraz, dzięki integracji licznika z Mission Control — centralnym hubem do zarządzania agentami — deweloperzy mają dostęp do dokładnych danych o konsumpcji tokenów w czasie rzeczywistym, bez potrzeby przełączania się między aplikacjami.

    Panel prezentuje zarówno ogólne statystyki, jak i szczegółowe rozbicie na poszczególne zadania. To znaczące ułatwienie dla zespołów DevOps, które muszą monitorować budżety przy intensywnym wykorzystaniu modeli językowych. Oznacza to mniej niespodzianek na fakturach i większą kontrolę nad kosztami infrastruktury AI.

    W tej samej aktualizacji poprawiono również błąd związany z nieprawidłowym zliczaniem tokenów dla subagentów. Wcześniej dane mogły być nieprecyzyjne, co utrudniało dokładne rozliczenia — teraz problem został rozwiązany.

    Optymistyczne przesyłanie — mniej czekania, więcej działania

    Optymistyczne przesyłanie — mniej czekania, więcej działania

    Drugim kluczowym elementem tej aktualizacji jest mechanizm optymistycznego przesyłania wiadomości. System nie czeka już na pełne potwierdzenie połączenia przed wysłaniem wiadomości do agenta. Działa na zasadzie „zakładamy, że wszystko pójdzie dobrze” i realizuje zapytanie od razu.

    Efekt to krótsze czasy reakcji, co jest szczególnie zauważalne przy szybkim iterowaniu kodu. Deweloperzy, którzy stosują metodę vibe coding, gdzie tempo i płynność pracy są kluczowe, od razu dostrzegą różnicę. Nie trzeba już czekać na kilka dodatkowych sekund przy każdym zapytaniu.

    Zespół Factory zaznacza, że mechanizm został zaprojektowany tak, aby nie wpływał negatywnie na stabilność sesji. W przypadku problemów system potrafi cofnąć operację i spróbować ponownie, co oznacza, że użytkownik nie traci danych ani kontekstu rozmowy.

    Poprawki i drobniejsze zmiany

    Poprawki i drobniejsze zmiany

    Oprócz głównych funkcji, wersja v0.123.0 wprowadziła kilka poprawek. Najważniejsza dotyczyła sesji — wcześniej zdarzało się, że nie ładowały się poprawnie po ponownym uruchomieniu, co mogło zakłócać pracę. Teraz ten problem został usunięty.

    Poprawiono także obsługę nazw narzędzi. Wcześniej niektóre komendy mogły być błędnie interpretowane przez agentów, zwłaszcza gdy zawierały niestandardowe znaki. Po aktualizacji mapowanie jest dokładniejsze, co zmniejsza liczbę nieoczekiwanych błędów w automatyzacjach.

    Warto również wspomnieć o powiadomieniach deprecjacyjnych. Jeśli któryś z używanych modeli zbliża się do końca wsparcia, Factory informuje o tym i sugeruje migrację na nowszą wersję. To małe udogodnienie oszczędza czas na ręczne sprawdzanie statusu kompatybilności.

    Co to oznacza dla zespołów AI i DevOps

    Ta aktualizacja wpisuje się w szerszy trend w narzędziach dla AI engineeringu, koncentrując się na transparentności kosztowej i niezawodności sesji. Dla osób zarządzających wieloma agentami jednocześnie, dokładne dane o zużyciu tokenów oraz poprawiona stabilność sesji mogą znacząco ułatwić pracę i zwiększyć efektywność.


    Źródła

  • Claude Opus 4.7 z trybem Fast Mode – 2,5 razy szybsza generacja i wejście na AWS

    Claude Opus 4.7 z trybem Fast Mode – 2,5 razy szybsza generacja i wejście na AWS

    12 maja 2026 roku Anthropic wprowadziło tryb Fast Mode dla modelu Claude Opus 4.7, który przyspiesza generowanie tokenów wyjściowych 2,5 razy. W tym samym czasie firma uruchomiła Claude Platform na AWS, co umożliwia deweloperom korzystanie z pełnego zestawu funkcji API, w tym Managed Agents i wykonywania kodu, bezpośrednio przez infrastrukturę Amazona, z natywnym rozliczaniem i uwierzytelnianiem.

    Kluczowe informacje

    • Fast Mode przyspiesza tylko generowanie tokenów wyjściowych – czas do pierwszego tokena pozostaje taki sam.
    • Cena wynosi 30 dolarów za 1 milion tokenów wejściowych i 150 dolarów za 1 milion wyjściowych – to sześć razy więcej niż standardowy Opus 4.7.
    • To nie nowy model – Fast Mode wykorzystuje te same wagi i mechanizmy co standardowy Opus 4.7; to jedynie priorytetowa ścieżka serwowania.
    • Claude Platform na AWS oferuje Managed Agents, webhooki, multi-agent orchestration oraz self-hosted sandboxy z natywnym billingiem.
    • Dostępność – research preview na API oraz w Claude Code od wersji 2.1.36.

    Fast Mode – szybszy, ale nie mądrzejszy

    Anthropic wyjaśnia, że Fast Mode to rozwiązanie infrastrukturalne, a nie algorytmiczne. Model nie działa szybciej – ma jedynie priorytetowy dostęp do mocy obliczeniowej. Jak opisuje dokumentacja: to ten sam samolot i to samo miejsce docelowe, tylko osobna kolejka na lotnisku.

    Przyspieszenie dotyczy wyłącznie tokenów wyjściowych. Streaming wydaje się szybszy, ale początkowe opóźnienie – czas oczekiwania na pierwszy token – pozostaje niezmienione. Dla programistów korzystających z Claude Code oznacza to płynniejszą iterację kodu i szybsze podpowiedzi, ale nie zmienia jakości odpowiedzi.

    Aktywacja trybu jest prosta. W Claude Code wystarczy wpisać komendę /fast, a w API – przekazać nagłówek beta fast-mode-2026-02-01 z parametrem speed: "fast". Należy jednak pamiętać, że przełączenie trybu w trakcie konwersacji powoduje naliczenie wyższej ceny za cały dotychczasowy kontekst, nie tylko za nowe wiadomości.

    Fast Mode nie współpracuje z Batch API ani Priority Tier. To narzędzie przeznaczone do zadań interaktywnych – szybkiego debugowania, iteracji kodu na żywo i wszędzie tam, gdzie liczy się każda sekunda.

    AWS i Managed Agents – Claude w ekosystemie Amazona

    Równolegle z Fast Mode Anthropic rozszerza obecność platformy na AWS. Deweloperzy korzystający z infrastruktury Amazona mają teraz dostęp do pełnego zestawu funkcji API bez konieczności zarządzania osobnym billingiem czy kluczami uwierzytelniającymi. Wszystko działa natywnie, przez IAM.

    Co dokładnie trafiło na AWS? Managed Agents z możliwością planowania sesji, webhooki do obsługi zdarzeń w czasie rzeczywistym, multi-agent orchestration oraz self-hosted sandboxy. Te ostatnie stanowią interesującą alternatywę dla domyślnej infrastruktury Anthropica – umożliwiają uruchamianie narzędzi agentów w własnym środowisku, co jest istotne dla firm z restrykcyjnymi wymogami bezpieczeństwa.

    Dla zespołów devopsowych oznacza to mniej integracyjnego boilerplate'u.


    Źródła