Tag: Agenci AI

  • Cursor wprowadza Security Review – automatyczne audyty bezpieczeństwa dla każdego PR i repozytorium

    Cursor wprowadza Security Review – automatyczne audyty bezpieczeństwa dla każdego PR i repozytorium

    Cursor wprowadził funkcję Security Review w wersji beta dla użytkowników planów Teams i Enterprise. To zestaw dwóch aktywnych agentów bezpieczeństwa, które integrują się z workflow pull requestów i skanowania kodu. Security Review analizuje każdy PR pod kątem podatności, a drugi agent regularnie przeszukuje całe repozytorium w poszukiwaniu problemów.

    Agenci działają w tle, pozostawiając komentarze przy liniach diffa i wysyłając powiadomienia na Slacka.

    Co przynosi nowa funkcja Cursor Security Review

    • Security Review sprawdza każdy pull request, szukając błędów autoryzacji, wycieków danych, ryzykownych autozatwierdzeń narzędzi agentowych oraz ataków prompt injection.
    • Security Review wykonuje zaplanowane audyty bazy kodu, wykrywając znane podatności, przestarzałe zależności i błędy konfiguracji.
    • Komentarze inline pokazują poziom krytyczności i sugerują kroki naprawcze w miejscu problemu.
    • Wyniki skanów trafiają na Slacka, co pozwala całemu zespołowi na natychmiastowe zapoznanie się z nimi, bez potrzeby przeszukiwania dashboardów.
    • Personalizacja agentów – można je dostosować własnymi instrukcjami, niestandardowymi narzędziami i integracjami z serwerami MCP.

    Security Review – strażnik każdego pull requesta

    Agent Security Review działa jak dodatkowy recenzent, który analizuje każdy PR. Szuka nie tylko oczywistych błędów, takich jak SQL injection czy hardkodowane sekrety, ale również ryzyk związanych z autozatwierdzaniem akcji narzędzi. Gdy agent IDE sam decyduje o wykonaniu komendy, może to otworzyć furtkę dla złośliwego kodu. Security Review identyfikuje także próby prompt injection, czyli sytuacje, w których ktoś przemyca instrukcje w komentarzach lub dokumentacji, wpływające na zachowanie AI.

    Komentarze są umieszczane bezpośrednio w diffa, co pozwala zespołowi zobaczyć, co jest nie tak oraz jak to naprawić, bez konieczności przeszukiwania zewnętrznych raportów.

    Security Review – regularne przeglądy całej bazy kodu

    Drugi agent działa w inny sposób. Nie czeka na nowy kod, lecz skanuje repozytorium według ustalonego harmonogramu. Szuka znanych podatności w zależnościach, przestarzałych paczkach i błędach konfiguracyjnych, które mogły umknąć podczas przeglądu PR.

    Wyniki skanów są wysyłane na Slacka, co pozwala zespołowi na szybkie reagowanie na problemy, zanim trafią na produkcję. Dla zespołów devopsowych i hostingowych to znaczące ułatwienie.

    Cursor wykorzystuje te agenty wewnętrznie, przeglądając ponad 3000 PR-ów tygodniowo i identyfikując ponad 200 realnych podatności. To dowód na to, że narzędzie działa efektywnie w produkcji.

    Dlaczego to ważne dla zespołów web dev i AI coding

    W świecie szybkiego kodowania, gdzie kod powstaje bez głębokiej analizy, automatyzacja Security Review staje się koniecznością. Cursor kieruje swoją ofertę do zespołów, które korzystają z agentów AI do generowania kodu i potrzebują zapewnienia, że ani człowiek, ani model nie wprowadzą niebezpiecznych elementów.

    Możliwość dostosowania agentów przez MCP i własne narzędzia to ważny krok w stronę potrzeb dużych firm.


    Źródła

  • OpenCode v1.14.31: Lepsza integracja z Azure i większa stabilność dla programistów

    OpenCode v1.14.31: Lepsza integracja z Azure i większa stabilność dla programistów

    Najnowsza aktualizacja OpenCode, oznaczona numerem v1.14.31, koncentruje się na usprawnieniu konfiguracji usługi Azure, zapobieganiu krytycznym awariom aplikacji desktopowej oraz wprowadzeniu szeregu poprawek stabilności. Wydana 30 kwietnia 2026 roku, ta wersja odpowiada na potrzeby zespołów deweloperskich, które w swoich codziennych zadaniach polegają na integracji z chmurą Microsoftu. OpenCode, jako otwartoźródłowy agent kodowania AI do użytku w terminalu, IDE i na pulpicie, umacnia swoją pozycję jako niezawodne narzędzie, kładąc nacisk na poprawę istniejących funkcji i eliminację błędów.

    Kluczowe informacje o wydaniu

    • Data wydania: 30 kwietnia 2026 roku.
    • Główna zmiana: Usprawniony proces konfiguracji Azure, który monituje o nazwy zasobów i zapisuje je bezpośrednio z kluczami API.
    • Krytyczna poprawka: Aplikacja desktopowa nie ulega już awarii podczas przywracania zapisanych wiadomości, gdy brakuje określonego modelu.
    • Stabilność: Sesje zadań potomnych prawidłowo dziedziczą uprawnienia katalogu nadrzędnego, a obsługa błędów dla nieprawidłowych adresów URL MCP jest teraz bardziej przejrzysta.
    • Zakres aktualizacji: 1 ulepszenie i 3 poprawki błędów.

    Usprawniony przepływ konfiguracji Azure – mniej błędów, więcej efektywności

    Najważniejszą zmianą z perspektywy użytkownika jest poprawa procesu konfiguracji Azure. Dotychczas łączenie OpenCode z zasobami w chmurze Microsoftu mogło być źródłem frustracji, szczególnie w złożonych środowiskach, gdzie zarządza się wieloma instancjami. Nowa wersja rozwiązuje ten problem, wprowadzając interaktywny monit o nazwy zasobów. Aplikacja teraz zapisuje te nazwy bezpośrednio razem z kluczami API, co eliminuje konieczność ręcznego edytowania plików konfiguracyjnych. Dla zespołów DevOps i inżynierów AI, którzy często przełączają się między projektami, ta zmiana skraca czas potrzebny na skonfigurowanie środowiska i minimalizuje ryzyko błędów wynikających z wpisania nieprawidłowych danych uwierzytelniających. To krok w stronę bardziej zintegrowanego narzędzia, które rozumie, że dane dostępowe i identyfikatory zasobów stanowią nierozerwalną całość.

    Stabilność na pierwszym planie: od uprawnień po obsługę błędów

    Stabilność na pierwszym planie: od uprawnień po obsługę błędów

    Aktualizacja v1.14.31 przynosi trzy istotne poprawki, które znacząco podnoszą komfort pracy. Pierwsza z nich dotyczy sesji zadań potomnych, które teraz w niezawodny sposób zachowują uprawnienia katalogu nadrzędnego. Wcześniej użytkownicy mogli napotykać problemy z dostępem do plików w zagnieżdżonych sesjach roboczych, co przerywało tok pracy i wymagało ręcznej interwencji.

    Drugą ważną zmianą jest poprawa obsługi błędów dla nieprawidłowych zdalnych adresów URL MCP (Model Context Protocol). W poprzednich wersjach problem z konfiguracją połączenia mógł skutkować niejasnym komunikatem. Teraz OpenCode dostarcza czytelniejsze informacje zwrotne, co pozwala programistom szybko zidentyfikować literówkę w adresie lub problem z dostępnością serwera i wrócić do pracy bez długotrwałego debugowania.

    Koniec z krytycznymi awariami desktopu

    Dla użytkowników aplikacji desktopowej v1.14.31 to wydanie obowiązkowe. Zawiera ono krytyczną poprawkę eliminującą awarię, która występowała podczas przywracania zapisanych wiadomości, gdy brakowało konkretnego modelu AI. Tego typu błąd mógł prowadzić do utraty kontekstu całej sesji i konieczności rozpoczynania pracy od nowa. Zespół OpenCode zareagował na ten problem w wydaniu punktowym, co podkreśla jego zaangażowanie w dostarczanie stabilnego i przewidywalnego środowiska pracy.

    To wydanie wpisuje się w szerszy trend rozwoju OpenCode, który koncentruje się na "utwardzaniu" aplikacji. Twórcy systematycznie pracują nad obsługą sesji, rutowaniem uprawnień i niezawodnością interfejsu, co dla profesjonalistów jest często ważniejsze niż nowe funkcje. OpenCode v1.14.31 to solidny krok naprzód w budowaniu zaufania do narzędzia jako fundamentu codziennego warsztatu deweloperskiego.


    Źródła

  • Claude Code 2.1.126 wprowadza czyszczenie projektów i ostrzejszą kontrolę uprawnień

    Claude Code 2.1.126 wprowadza czyszczenie projektów i ostrzejszą kontrolę uprawnień

    Nowa wersja Claude Code wprowadza narzędzie do zarządzania stanem projektów oraz usprawnienia w zakresie bezpieczeństwa, które są szczególnie przydatne dla zespołów pracujących z wrażliwymi danymi i zautomatyzowanymi pipeline'ami. Aktualizacja 2.1.126 przynosi również poprawki dla użytkowników Windows.

    Kluczowe zmiany w skrócie

    • claude project purge — nowe polecenie usuwa wszystkie dane stanu projektu, w tym transkrypcje, zadania i historię plików.
    • Udoskonalone pomijanie uprawnień — funkcja permission-skipping działa teraz bardziej przewidywalnie, co ułatwia automatyzację.
    • Kody OAuth w terminalu — uwierzytelnianie można przeprowadzić bezpośrednio w CLI, bez przekierowań do przeglądarki.
    • Niestandardowe endpointy API — model picker obsługuje już własne bramy, co jest ważne dla wdrożeń enterprise.
    • Stabilność na Windows — poprawki dla środowisk terminalowych i obsługi obrazów.

    Czyszczenie projektu jednym poleceniem

    Nowa komenda claude project purge [path] pozwala szybko usunąć cały lokalny stan powiązany z danym projektem, w tym transkrypcje sesji, kolejkowanie zadań, historię plików oraz wpisy konfiguracyjne. Użytkownicy mogą skorzystać z przełącznika --dry-run, aby zobaczyć, co dokładnie zostanie usunięte, zanim podejmą decyzję.

    To narzędzie jest szczególnie przydatne dla developerów, którzy często zmieniają gałęzie czy projekty klientów. Zamiast ręcznie czyścić wiele katalogów z cache'em, wystarczy jedno polecenie. Takie rozwiązanie było oczekiwane, zwłaszcza gdy po testach pozostawały niepotrzebne dane wpływające na kolejne sesje.

    Bezpieczeństwo i automatyzacja pod kontrolą

    Anthropic poprawiło mechanizm permission-skipping, który teraz działa bardziej przewidywalnie w zautomatyzowanych workflow. W sytuacjach, gdy Claude Code wykonuje szereg operacji, nie powinien pytać o zgodę przy każdej z nich, co jest istotne podczas refaktoryzacji wielu plików czy uruchamiania skryptów CI/CD.

    Dodatkowo, użytkownicy mogą teraz wpisywać kody OAuth bezpośrednio w terminalu. Wcześniej proces uwierzytelniania wymagał otwierania przeglądarki i kopiowania tokenów, co bywało frustrujące w przypadku pracy na zdalnych serwerach. Teraz cały proces odbywa się w oknie CLI, co ułatwia konfigurację środowiska na VPS-ie czy w kontenerze Docker.

    Elastyczność dla zespołów enterprise

    Elastyczność dla zespołów enterprise

    Wsparcie dla niestandardowych endpointów API w model pickerze to odpowiedź na potrzeby organizacji, które kierują ruch przez własne bramy lub proxy. Jeśli firma korzysta z wewnętrznego routingu do modeli Claude, teraz można to skonfigurować bez skomplikowanych rozwiązań.

    To również dobra wiadomość dla zespołów DevOps, które zarządzają dostępem do AI przez scentralizowane punkty kontrolne. Nie trzeba już wybierać między bezpieczeństwem infrastruktury a wygodą korzystania z Claude Code.

    Windows wreszcie dostaje uwagę

    Windows wreszcie dostaje uwagę

    Użytkownicy Windows od dawna zgłaszali problemy ze stabilnością, szczególnie podczas intensywnego przetwarzania obrazów i długich sesji terminalowych. Aktualizacja 2.1.126 koncentruje się na tych problemach, poprawiając obsługę plików graficznych, które wcześniej mogły powodować nieoczekiwane wyłączenia sesji, oraz stabilność komponentów odpowiedzialnych za renderowanie w terminalu.

    Dla zespołów pracujących na różnych systemach operacyjnych to istotna zmiana. Debugowanie problemów, które występują tylko na Windows, podczas gdy reszta zespołu korzysta z macOS czy Linuksa, bywa frustrujące.

    Drobne, ale istotne poprawki

    Oprócz wymienionych nowości, wydanie zawiera także mniejsze poprawki błędów. Choć nie są one szczegółowo opisane w changelogu, wpływają na ogólną płynność działania i ciągłość sesji. Mniej zawieszeń i mniej niespodziewanych restartów buduje zaufanie do narzędzia, zwłaszcza gdy jest ono używane jako codzienny asystent przy kodzie.

    Co to oznacza dla developerów?

    Wydanie 2.1.126 pokazuje, że Anthropic reaguje na feedback od społeczności. Czystka projektu, normalne uwierzytelnianie OAuth w terminalu i lepsza stabilność na Windows to funkcje, które nie przyciągają dużej uwagi na konferencjach, ale mają kluczowe znaczenie dla codziennej pracy. Ta aktualizacja z pewnością przybliża Claude Code do spełnienia oczekiwań użytkowników.


    Źródła

  • Codex 0.128.0 wprowadza trwałe workflow i daje agentom pamięć, której do tej pory brakowało

    Codex 0.128.0 wprowadza trwałe workflow i daje agentom pamięć, której do tej pory brakowało

    OpenAI wprowadziło aktualizację Codex 0.128.0, która wprowadza istotne zmiany w sposobie, w jaki agenci radzą sobie z długotrwałymi zadaniami. Najważniejszą nowością jest trwałe zarządzanie kontekstem, które umożliwia agentowi tworzenie, wstrzymywanie i wznawianie zadań. Dodatkowo, aktualizacja oferuje szersze możliwości kontroli dostępu, usprawnione zarządzanie wtyczkami oraz lepszą orkiestrację wielu agentów. Wprowadzone zmiany obejmują również nowe kontrolki w interfejsie terminalowym oraz poprawki stabilności.

    Co nowego w aktualizacji Codex 0.128.0 — najważniejsze fakty

    • Trwałe stany zadań — agent może wracać do wcześniej zdefiniowanych celów i kontynuować pracę po przerwie, korzystając z zapamiętanego kontekstu.
    • Większe możliwości kontroli uprawnień — więcej opcji określania, do czego agent ma dostęp w środowisku deweloperskim.
    • Usprawnione wtyczki — lepsza jakość integracji i obsługi wtyczek.
    • Udoskonalona praca z wieloma agentami — płynniejsza współpraca i konfiguracja agentów w złożonych workflow.
    • Poprawki stabilności Windows — zwiększona niezawodność sandboksa i przewidywalność działania.

    Zarządzanie kontekstem — agent pamięta, nad czym pracuje

    Dotychczas praca z agentem przypominała rozmowę z kimś, kto po każdym „dziękuję” zapomina, o czym była mowa. Aktualizacja wprowadza mechanizmy trwałego kontekstu, dzięki którym agent zachowuje świadomość celu między sesjami. Można przerwać pracę, sprawdzić status i wrócić do zadania bez potrzeby tłumaczenia wszystkiego od nowa.

    Technicznie chodzi o ponowne wykorzystywanie wątków, kompresję konwersacji i planowanie długich zadań. Kontekst nie jest już tylko jednorazowym promptem — agent może odtwarzać stan i kontynuować złożone zadania. Dla osób pracujących nad wieloetapowym refaktoringiem lub projektem UI rozłożonym na kilka sesji, to znacząca zmiana.

    Co ważne, kontekst potrafi przetrwać przełączanie między wątkami. Agent nie gubi wątku, gdy przechodzimy z jednego obszaru pracy do drugiego. To krok w stronę modelu, w którym agent działa jako operator stanowy, a nie bezmyślny wykonawca jednorazowych poleceń.

    Więcej kontroli, mniej niespodzianek — uprawnienia i wtyczki

    Rozszerzone możliwości kontroli uprawnień odpowiadają na realny problem: jak dać agentowi swobodę działania, nie otwierając wszystkich drzwi. Aktualizacja pozwala lepiej określić, do czego agent ma dostęp, co jest istotne dla zespołów DevOps i hostingowych, które chcą bezpieczniej korzystać z Codex 0.128.0 w środowiskach produkcyjnych.

    Zarządzanie wtyczkami również zostało poprawione. Lepsza obsługa wtyczek oznacza mniej błędów przy instalacji i stabilniejsze działanie rozszerzeń. Dla web developerów korzystających z Codex 0.128.0 jako asystenta przy kodzie frontendu czy backendu to oznacza mniej frustracji przy konfiguracji środowiska.

    Orkiestracja wielu agentów i TUI — wszystko pod kontrolą

    Współpraca agentów w jednym workflow doczekała się usprawnień, które ułatwiają zarządzanie ich rolami. Chodzi o to, aby agenty nie wchodziły sobie w drogę, a konfiguracja była bardziej przewidywalna. Dla osób eksperymentujących z vibe codingiem i uruchamiających kilka agentów równolegle, to różnica między chaosem a sensowną orkiestracją.

    Interfejs terminalowy także został ulepszony. Nowe kontrolki TUI ułatwiają zarządzanie długotrwałymi zadaniami — łatwiej sprawdzić status, wznowić przerwane zadanie czy wyczyścić niepotrzebny stan.

    Windows i stabilność — mniej awarii, więcej przewidywalności

    Aktualizacja eliminuje kilka irytujących błędów. Na Windowsie zwiększono stabilność sandboksa i poprawiono niezawodność dostawców modeli, co przekłada się na mniej przerw w pracy. Dla użytkowników tego systemu to odczuwalna zmiana w codziennym korzystaniu z narzędzia.

    Kontekst ma znaczenie — dlaczego to istotne dla web devu i AI

    Dla osób pracujących z kodem na co dzień ta aktualizacja niesie konkretną wartość. Trwałe zarządzanie kontekstem sprawdza się przy zadaniach, które nie kończą się na jednej sesji — refaktoringu, budowaniu komponentów, testowaniu. Agent, który pamięta cele, to mniej czasu na odtwarzanie stanu i więcej na faktyczną pracę.

    Z perspektywy rozwoju AI widać wyraźny kierunek: agenty przestają być narzędziami jednorazowych promptów i stają się operatorami zdolnymi do długoterminowej współpracy. Ta aktualizacja to kolejny krok w tę stronę.


    Źródła

  • Zed 1.0: Kamień milowy dla edytora kodu – oto nowości, które zmienią Twoją pracę

    Zed 1.0: Kamień milowy dla edytora kodu – oto nowości, które zmienią Twoją pracę

    Po ponad tysiącu wersji i kilku latach intensywnego rozwoju, Zed – ultraszybki edytor kodu napisany w języku Rust – oficjalnie doczekał się stabilnej wersji 1.0. Projekt, stworzony przez Nathana Sobo, jednego z twórców Atom, osiągnął poziom dojrzałości, który pozwala określić go jako „kompletny edytor kodu”. Wydanie to oznacza nie tylko zakończenie pewnego etapu, ale także wprowadzenie wielu funkcji, które znacznie poprawiają komfort pracy programistów na systemach macOS, Windows i Linux.

    Najważniejsze informacje

    • Zed 1.0 to pierwsza stabilna wersja edytora, po ponad 1000 wydaniach przedpremierowych.
    • Nowe funkcje obejmują trwałe zakładki, ulepszone dopasowywanie rozmyte, wsparcie dla modeli AI (w tym Zeta LLM) oraz animacje GIF w podglądzie Markdown.
    • Zed 1.0 od początku pisany jest w Rust, co zapewnia szybkie działanie na wszystkich trzech głównych platformach.
    • Edytor stawia na współpracę z AI, integrując modele językowe jako asystentów kodowania.
    • Git zyskał rozbudowane narzędzia, a stabilność została poprawiona dzięki setkom poprawek błędów.

    Od tysiąca wersji do 1.0 – droga do dojrzałości

    Zed 1.0 rozpoczął życie jako eksperyment mający połączyć wydajność Rust z nowoczesnym podejściem do edycji kodu. Przez kilka lat zespół Zed Industries wprowadzał kolejne aktualizacje co tydzień, poprawiając silnik graficzny, parser drzewa składniowego oraz mechanizmy współpracy. Po przekroczeniu tysiąca edycji, twórcy uznali, że edytor spełnia obietnicę „kompletności”. Stabilna wersja 1.0 to sygnał, że środowisko jest wystarczająco dojrzałe i stabilne, aby można je było bez obaw wykorzystywać w codziennej pracy produkcyjnej.

    Nowości, które robią różnicę

    Najnowsze wydanie przynosi kilka funkcji, o które społeczność prosiła od dawna. Trwałe zakładki zapamiętują pozycję w kodzie między sesjami, co jest przydatne dla osób pracujących z dużymi bazami kodu. Dopasowywanie rozmyte zostało usprawnione, co przyspiesza przeskakiwanie między plikami i uzupełnianie ścieżek. W obszarze AI poprawiono wsparcie dla modeli językowych – Zed 1.0 współpracuje teraz z własnym modelem Zeta LLM oraz zewnętrznymi dostawcami, oferując kontekstowe sugestie i asystę. Podgląd Markdown obsługuje teraz animowane obrazy GIF, co ułatwia dokumentowanie projektów i notatki. Przeprojektowane narzędzia Git oferują wygodniejszy widok diffów i usprawnienia w zarządzaniu gałęziami, co przyspiesza przeglądanie repozytoriów.

    Zed 1.0 a konkurencja – szybkość i współpraca

    W przeciwieństwie do wielu edytorów, Zed 1.0 nie korzysta z silnika Electron, lecz z własnej, natywnej warstwy interfejsu stworzonej w Rust. Dzięki temu uruchamia się bardzo szybko, a przewijanie i operacje na tekście pozostają płynne nawet przy dużych plikach. Duży nacisk kładziono na współpracę: edytor umożliwia jednoczesną pracę wielu osób nad tym samym projektem, z opcją udostępniania kanałów terminala i edytora. Integracja z modelami AI, w tym zewnętrznymi dostawcami i własnym Zeta LLM, pozwala na kontekstowe podpowiedzi, refaktoryzację czy generowanie kodu bez opuszczania edytora, co sprawia, że praca staje się bardziej zintegrowana.

    Stabilność na trzech platformach i setki poprawek

    Wydanie 1.0 to także ogromny wysiłek związany z usuwaniem błędów. Wprowadzono liczne poprawki stabilności, obejmujące m.in. renderowanie diagnostyki, kompatybilność z różnymi środowiskami graficznymi oraz integrację z Language Server Protocol. Zespół zadbał o spójne działanie narzędzi AI z różnymi dostawcami. Dzięki tym działaniom Zed 1.0 na macOS, Windows i Linux działa przewidywalnie, a inżynierowie pracujący w różnych środowiskach mogą liczyć na identyczne doświadczenia wszędzie tam, gdzie go zainstalują.

    Przejście do wersji 1.0 to nie tylko formalność – to zachęta dla programistów, którzy czekali na oznakę dojrzałości, by dać Zedowi 1.0 szansę. Szybkość, natywne wsparcie dla AI i nowe narzędzia Git sprawiają, że edytor ten może poważnie zagrozić dominacji VS Code, zwłaszcza wśród osób ceniących lekkość i współpracę w czasie rzeczywistym.


    Źródła

  • Claude Code 2.1.122: konfigurowalne poziomy usług Bedrock i inteligentniejsze wznawianie sesji

    Claude Code 2.1.122: konfigurowalne poziomy usług Bedrock i inteligentniejsze wznawianie sesji

    Anthropic wprowadziło aktualizację Claude Code 2.1.122, która dodaje zmienną środowiskową ANTHROPIC_BEDROCK_SERVICE_TIER do konfiguracji poziomów usług AWS Bedrock oraz poprawia mechanizm wznawiania sesji przez adresy URL pull requestów. To wydanie jest skierowane głównie do zespołów DevOps i deweloperów pracujących w regulowanych środowiskach, gdzie kontrola nad infrastrukturą jest kluczowa.

    Kluczowe zmiany w skrócie

    • ANTHROPIC_BEDROCK_SERVICE_TIER umożliwia wybór między default, flex a priority bez potrzeby modyfikacji kodu aplikacji.
    • Wznawianie sesji przez PR URL ułatwia odzyskiwanie kontekstu w długotrwałych zadaniach i przerywanych sesjach terminalowych.
    • Usprawnione logowanie OpenTelemetry zwiększa transparentność w agentowych workflow.
    • Poprawki stabilności obejmują m.in. fork branchy, resize obrazów i zachowanie powłoki terminala.

    Bedrock zyskuje warstwy usług – co to znaczy w praktyce

    Nowa zmienna ANTHROPIC_BEDROCK_SERVICE_TIER odpowiada na potrzeby zespołów korzystających z Claude'a przez AWS Bedrock. Wysłana jako nagłówek X-Amzn-Bedrock-Service-Tier, przyjmuje trzy wartości: default, flex oraz priority.

    Dzięki temu można dostosować zachowanie modelu na poziomie żądania – wybierając niższy priorytet dla zadań wsadowych lub wyższy dla interaktywnych sesji deweloperskich, gdzie opóźnienie jest szczególnie odczuwalne. Nie ma potrzeby zmiany kodu ani architektury – wystarczy ustawić zmienną środowiskową.

    Claude Code 2.1.122 został udostępniony w Bedrock z kontekstem 200 000 tokenów (około 150 000 słów, czyli ponad 500 stron tekstu), a integracja była od początku pozycjonowana jako rozwiązanie do budowy aplikacji gotowych do użycia w przedsiębiorstwie. Teraz zyskujesz dodatkową dźwignię operacyjną – idealną w środowiskach wielokontowych, gdzie różne zespoły mają różne wymagania dotyczące throughputu i kosztów.

    Wznawianie sesji przez PR – koniec zgadywania

    Wznawianie sesji przez PR – koniec zgadywania

    Każdy, kto spędził godziny na debugowaniu w terminalu, zna ten moment paniki: sesja się rozłącza, prompt znika, a Claude nagle nie pamięta, nad czym pracowałeś. Wydanie 2.1.122 rozwiązuje ten problem, umożliwiając znajdowanie sesji po adresie URL pull requesta.

    Mechanizm jest prosty, ale skuteczny. Jeśli prowadzisz długą sesję programistyczną powiązaną z konkretnym PR-em, możesz ją teraz łatwo odzyskać. To szczególnie istotne w scenariuszach, gdzie utrata kontekstu może znacznie obniżyć produktywność.

    Logowanie OpenTelemetry i poprawki infrastrukturalne

    Logowanie OpenTelemetry i poprawki infrastrukturalne

    Obserwowalność jest obecnie wymogiem. Rozszerzone logowanie OpenTelemetry w tej wersji daje lepszy wgląd w to, co robią agenci Claude'a – od wywołań narzędzi po decyzje klasyfikatora trybu auto.

    Dodatkowo Anthropic poprawiło kilka irytujących błędów. Udoskonalone zostało zachowanie przy fork branchy, gdzie wcześniej mogło dochodzić do niespójności. Naprawiono również resize obrazów w kontekście przetwarzania przez model oraz ujednolicono działanie powłoki terminala, co doceni każdy, kto miał problemy z różnymi emulatorami.

    Co to znaczy dla deweloperów

    Aktualizacja 2.1.122 nie wprowadza rewolucyjnych zmian, co jest pozytywne. To solidny zestaw ulepszeń, które eliminują problemy, z którymi deweloperzy borykali się od tygodni. Konfigurowalne poziomy Bedrock to korzyść dla zespołów dbających o koszty w AWS. Wznawianie sesji przez PR to z kolei udogodnienie dla tych, którzy pracują z Claude'em przez dłuższy czas i nie mogą sobie pozwolić na utratę kontekstu.

    Takie aktualizacje często są niedoceniane w świecie AI, gdzie uwaga skupia się na spektakularnych nowościach. Jednak to właśnie drobne poprawki w logowaniu, powłoce terminala i obsłudze nagłówków tworzą narzędzie, na którym można polegać w produkcji.

    Szczegóły techniczne i pełną listę zmian można znaleźć w oficjalnym changelogu Claude Code.


    Źródła

  • Qwen Code v0.15.5: Nowe narzędzia CLI i lepsze zarządzanie zadaniami w tle

    Qwen Code v0.15.5: Nowe narzędzia CLI i lepsze zarządzanie zadaniami w tle

    Najnowsza wersja Qwen Code, oznaczona jako v0.15.5, wprowadza szereg funkcji skoncentrowanych na interfejsie wiersza poleceń, które znacznie poprawiają zdolność agenta do organizowania złożonych przepływów pracy. Poprzednie wersje już zapewniały solidne wsparcie jako terminalowy asystent kodowania AI, ale ta aktualizacja przekształca go w centrum dowodzenia dla zautomatyzowanych zadań. Wprowadza wsparcie dla protokołu Model Context Protocol (MCP), nowy interfejs użytkownika oparty na tmux oraz lepszą obsługę procesów w tle, a także poprawia stabilność poprzez usunięcie krytycznych błędów.

    Kluczowe fakty o Qwen Code i aktualizacji v0.15.5

    • Qwen Code to agent AI typu open-source działający w terminalu, zoptymalizowany dla modelu Qwen3-Coder. Oferuje narzędzia do operacji na plikach, poleceń powłoki, pobierania danych z sieci, zarządzania pamięcią, listami zadań oraz delegowania podzadań.
    • Wersja v0.15.5 wprowadza wsparcie dla konfiguracji Model Context Protocol (MCP), poprawia integrację z powłoką systemową w tle oraz dodaje mechanizm logowania testów TUI oparty na tmux.
    • Aktualizacja koncentruje się na poprawkach niezawodności, naprawiając błędy związane z odtwarzaniem wywołań narzędziowych modeli DeepSeek oraz odświeżaniem nagłówka CLI przy przełączaniu modeli.
    • Instalacja odbywa się standardowo przez menedżera pakietów npm, a wymagane jest środowisko Node.js w wersji 20 lub nowszej, co ułatwia dostęp dla zespołów DevOps i deweloperów.

    Protokół MCP – klucz do ekosystemu narzędzi

    Do tej pory Qwen Code oferował zamknięty zestaw wbudowanych funkcji. Wprowadzenie wsparcia dla Model Context Protocol (MCP) otwiera go na zewnętrzne serwery narzędziowe. Protokół ten umożliwia integrację z serwerami MCP, co oznacza, że agent może teraz bezpiecznie komunikować się z bazami danych, API wewnętrznych usług oraz specjalistycznymi narzędziami firm trzecich. Dla web deweloperów oznacza to, że Qwen Code nie tylko edytuje kod, ale po zapisaniu zmian automatycznie uruchamia testy przez dedykowany serwer MCP i sprawdza ich wyniki. Ta zmiana przekształca narzędzie z asystenta kodowania w integralny element zautomatyzowanego łańcucha dostarczania oprogramowania.

    Nowa jakość zadań w tle i inspekcja z tmux

    Ulepszone dialogi zadań w tle oraz lepsza integracja z powłoką rozwiązują problem agentów AI związany z długotrwałymi procesami. Uruchamianie testów jednostkowych, budowanie obrazu Dockera czy wdrażanie na środowisko stagingowe często zajmuje sporo czasu. Wcześniejsze implementacje wymuszały na użytkownikach pasywne czekanie lub gubienie kontekstu. Teraz, dzięki ulepszonym dialogom, status zadania oraz kluczowe logi są widoczne w interfejsie, co nie zaśmieca głównego okna rozmowy.

    Warto również zwrócić uwagę na wprowadzenie umiejętności opartej na tmux do logowania testów TUI (Terminal User Interface). tmux, jako multiplekser terminala, umożliwia niezawodne sesjonowanie i przechwytywanie skomplikowanych, interaktywnych wyjść programów. W kontekście Qwen Code, ta funkcja zapewnia, że logi z uruchomionych w tle narzędzi są dostępne i łatwe do analizy.


    Źródła

  • Windsurf Editor z obsługą GPT-5.5: nowy wymiar agentowego kodowania dostępny dla wszystkich użytkowników

    Windsurf Editor z obsługą GPT-5.5: nowy wymiar agentowego kodowania dostępny dla wszystkich użytkowników

    Zgodnie z najnowszym wpisem na oficjalnym changelogu, edytor Windsurf udostępnił użytkownikom model GPT-5.5 od OpenAI. To kolejny krok w integracji najnowszych modeli językowych z tym środowiskiem programistycznym, które w ostatnich miesiącach systematycznie rozszerza swoją ofertę o kolejne wersje serii GPT-5. Aktualizacja jest dostępna dla wszystkich użytkowników Windsurf, niezależnie od planu subskrypcyjnego, bez dodatkowych opłat. Twórcy wprowadzili również zestaw poprawek stabilności, koncentrując się na usprawnieniu procesu uwierzytelniania OAuth dla różnych serwerów MCP, co jest istotne dla płynnej integracji zewnętrznych narzędzi i usług.

    Kluczowe informacje o aktualizacji

    • GPT-5.5 jest dostępny w edytorze Windsurf – oficjalny changelog potwierdza to wpisem „GPT-5.5 is now available in Windsurf”.
    • Wszyscy użytkownicy mają dostęp do modelu bez dodatkowych opłat czy ograniczeń planu, co wyróżnia tę premierę na tle wcześniejszych promocji limitowanych do płatnych kont.
    • Poprawki OAuth dla serwerów MCP zostały wdrożone w ramach tej samej aktualizacji, eliminując problemy z autoryzacją i zwiększając stabilność integracji.
    • Wyniki agentowe GPT-5.5 według OpenAI: 82,7% na Terminal-Bench 2.0 oraz 58,6% na SWE-Bench Pro, co stawia go w czołówce modeli do złożonych zadań programistycznych.
    • Strategia Windsurf obejmuje obsługę wielu modeli (GPT, Claude, SWE-1.x i BYOK), a dodanie GPT-5.5 wpisuje się w szybkie tempo adopcji kolejnych wersji serii GPT-5.

    Nowy model GPT-5.5 w Windsurf – co to oznacza dla programistów?

    Wprowadzenie GPT-5.5 to nie tylko kolejna pozycja w menu wyboru modelu. OpenAI pozycjonuje ten model jako krok w kierunku agentowego kodowania, w którym asystent nie tylko generuje fragmenty kodu, ale także planuje, wykonuje zadania w terminalu, przeszukuje kod źródłowy i dostosowuje się do kontekstu projektu. Wyniki na benchmarkach Terminal-Bench 2.0 (82,7%) i SWE-Bench Pro (58,6%) pokazują, że model ten potrafi rozwiązywać rzeczywiste problemy inżynieryjne z wysoką skutecznością, zwłaszcza w zadaniach wymagających interakcji z powłoką i złożonego debugowania.

    Dla użytkowników Windsurf oznacza to dostęp do bardziej precyzyjnego i kontekstowego asystenta bezpośrednio w edytorze. Model może teraz skuteczniej analizować strukturę projektu, rozumieć zależności i proponować rozwiązania uwzględniające szerszy kontekst architektoniczny. W połączeniu z funkcjami agentowymi Windsurf, takimi jak Cascade czy integracja z Devin, GPT-5.5 staje się silnikiem do automatyzacji złożonych przepływów pracy – od refaktoryzacji całych modułów po generowanie testów i dokumentacji.

    Stabilność integracji: naprawione błędy OAuth dla MCP

    Równocześnie z premierą modelu, zespół Windsurf opublikował poprawki związane z problemami autoryzacyjnymi OAuth dla wielu serwerów MCP. Model Context Protocol (MCP) jest wykorzystywany do integracji narzędzi zewnętrznych – od baz danych po API chmurowe – bezpośrednio w środowisku programistycznym. Niestabilności w procesie OAuth mogły prowadzić do przerw w połączenia.


    Źródła

  • Gemini CLI zyskał tryb głosowy w czasie rzeczywistym i silniejsze zabezpieczenia

    Gemini CLI zyskał tryb głosowy w czasie rzeczywistym i silniejsze zabezpieczenia

    Wydanie Gemini CLI w wersji 0.41.0-preview.0, ogłoszone 5 maja 2026 roku, wprowadza nowy tryb głosowy działający w czasie rzeczywistym, który obsługuje zarówno backendy chmurowe, jak i lokalne. W tym wydaniu wzmocniono również bezpieczeństwo, wprowadzając bezpieczne ładowanie plików .env, wymuszenie zaufania do workspace w trybie headless oraz bardziej restrykcyjną walidację poleceń shell. Aktualizacja zawiera także poprawki błędów, w tym rozwiązanie problemu z klawiszem backspace na systemie Windows oraz ulepszoną detekcję zapętlenia.

    Najważniejsze fakty dotyczące aktualizacji

    • Tryb głosowy w czasie rzeczywistym: Wersja v0.41.0-preview.0 umożliwia prowadzenie głosowej konwersacji z agentem AI zarówno poprzez infrastrukturę chmurową, jak i lokalne backendy.
    • Usprawnienia bezpieczeństwa: Zwiększono ochronę środowiska developerskiego poprzez bezpieczne ładowanie plików .env, wymuszenie zaufania do workspace w trybie headless oraz restrykcyjną walidację poleceń shell.
    • Naprawa błędów i poprawa wydajności: Wydanie obejmuje szereg napraw, w tym rozwiązanie problemu klawisza backspace na Windows oraz usprawnienia mechanizmów detekcji zapętlenia i inne optymalizacje.

    Tryb głosowy dla interakcji z terminalem

    Najważniejszą zmianą jest dodanie trybu głosowego działającego w czasie rzeczywistym. Funkcja, opisana w changelogu jako „Implemented real-time voice mode with cloud and local backends”, pozwala na komunikację z Gemini CLI za pomocą mówionych poleceń oraz otrzymywanie odpowiedzi w formie audio. To zmienia sposób interakcji z terminalem, zwłaszcza w sytuacjach, gdy ręczne wpisywanie komend jest niewygodne lub gdy chcemy szybko zadać pytanie podczas pracy z innym narzędziem. Tryb lokalny umożliwia działanie bez stałego połączenia z chmurą, co jest istotne dla użytkowników dbających o prywatność danych lub pracujących w środowiskach z ograniczonym dostępem do sieci.

    Priorytet bezpieczeństwa: środowisko i polecenia

    Wydanie v0.41.0-preview.0 koncentruje się na bezpieczeństwie, które jest kluczowe dla CLI agenta mającego dostęp do środowiska developerskiego i możliwość wykonywania poleceń systemowych. Bezpieczne ładowanie plików .env chroni wrażliwe dane konfiguracyjne i klucze API przed przypadkowym ujawnieniem. Wymuszenie zaufania do workspace w trybie headless zapewnia, że agent nie będzie operował na niezaufanych projektach bez zgody użytkownika.

    Ulepszona walidacja poleceń shell oraz dodanie listy dozwolonych narzędzi stanowią dodatkową barierę. Te zabezpieczenia odpowiadają na rosnącą złożoność i potencjalne ryzyko związane z agentami AI działającymi w terminalu.

    Naprawy błędów i usprawnienia wydajności

    Oprócz głównych funkcjonalności, aktualizacja przynosi szereg napraw i optymalizacji, które poprawiają stabilność i doświadczenie użytkownika. Naprawa regresji klawisza backspace na Windows rozwiązuje problem, który mógł utrudniać edycję tekstu w interfejsie CLI. Ulepszona detekcja zapętlenia pomaga agentowi w rozpoznaniu i uniknięciu cyklicznych, nieskończonych operacji.

    Wydanie jest częścią ciągłego cyklu rozwoju Gemini CLI.

    Kontekst dla web dev, vibe coding i DevOps

    Dodanie trybu głosowego w czasie rzeczywistym otwiera nowe możliwości dla developerów, szczególnie w kontekście „vibe coding” — bardziej swobodnego, konwersacyjnego podejścia do programowania. Możliwość szybkiego zadania pytania dotyczącego dokumentacji, struktury projektu lub składni podczas pracy w edytorze może znacząco przyspieszyć proces twórczy.

    Z perspektywy DevOps, bezpieczne ładowanie .env i walidacja poleceń shell są kluczowe dla bezpiecznego zarządzania infrastrukturą i ciągłego procesu dostarczania. Agent CLI, który może automatycznie wykonywać skrypty wdrożeniowe lub monitorować stan serwerów, musi działać w maksymalnie zabezpieczonym środowisku, aby nie stać się punktem ataku.

    Perspektywy rozwoju i wpływ na ekosystem AI

    Wydanie v0.41.0-preview.0 pokazuje kierunek rozwoju Gemini CLI w stronę bardziej interaktywnej i bezpiecznej integracji AI z codziennymi workflow developerskimi. Połączenie zaawansowanych funkcji głosowych z silnymi zabezpieczeniami środowiska wskazuje, że Google dąży do tego, aby ten agent stał się nie tylko pomocnym narzędziem, ale także bezpiecznym partnerem w terminalu.

    W kontekście szerszego ekosystemu AI, gdzie konkurencja między agentami CLI, takimi jak Cursor, Windsurf i Claude Code, jest intensywna, takie funkcje mogą być kluczowym czynnikiem różnicującym.


    Źródła

  • Codex 0.125.0 wprowadza Unix socket, lepszą obsługę AWS Bedrock i śledzenie tokenów

    Codex 0.125.0 wprowadza Unix socket, lepszą obsługę AWS Bedrock i śledzenie tokenów

    OpenAI wydało Codex 0.125.0, swojego agenta AI do programowania. Ta aktualizacja koncentruje się na integracji z serwerem aplikacji oraz ulepszonym zarządzaniu modelami AI. Wśród najważniejszych zmian znajdują się poprawione profile uprawnień oraz możliwość śledzenia zużycia tokenów z poziomu CLI. Wydanie naprawia również kilka problemów związanych ze stabilnością, szczególnie w systemach Windows.

    Nowości są ważne dla deweloperów pracujących z lokalnymi agentami AI, złożonymi środowiskami DevOps oraz dla zespołów korzystających z różnych dostawców modeli, takich jak AWS Bedrock. To krok w kierunku zwiększenia operacyjnej niezawodności i elastyczności Codex 0.125.0 jako platformy do kodowania wspomaganego przez AI.

    Kluczowe zmiany

    • Ulepszone zarządzanie środowiskami — sesje app-server mogą teraz zachować kontekst środowiska między interakcjami, co zmniejsza "dryft konfiguracji" w długotrwałych workflowach.
    • Obsługa AWS Bedrock — system może korzystać z modeli dostępnych w ramach kont AWS Bedrock, co jest istotne dla dynamicznego routingu w środowiskach z wieloma dostawcami.
    • Śledzenie zużycia tokenów w CLI — komenda codex exec --json raportuje zużycie tokenów, co daje deweloperom wgląd w koszty i wykorzystanie modelu.

    Wydajniejsze integracje lokalne

    Najważniejszą zmianą jest poprawa integracji app-server. Wcześniej komunikacja odbywała się głównie przez sieć (HTTP/WebSocket). Zmiana poprawia WebSocket connections dla klientów app-server, co zwiększa stabilność długotrwałych sesji.

    W praktyce oznacza to, że Codex 0.125.0 może teraz współpracować z innymi lokalnymi narzędziami, serwisami lub reverse-proxy w bardziej efektywny sposób. To szczególnie ważne dla środowisk containerized, gdzie agent działa jako sidecar, oraz dla lokalnych workflowów deweloperów, gdzie każda milisekunda opóźnienia ma znaczenie.

    Lepsze zarządzanie środowiskami

    Nowa wersja wprowadza ulepszone zarządzanie środowiskami. W długotrwałych sesjach Codex 0.125.0, takich jak CI/CD pipeline czy podczas rozbudowanych sesji developmentowych, kontekst środowiska (zmienne, stan plików, konfiguracja) mógł się "rozpadać" między restartami agenta. Ulepszone zarządzanie pozwala na utrzymanie tego kontekstu, co redukuje konieczność ponownego setupu i zapewnia większą ciągłość pracy.

    Obsługa AWS Bedrock i śledzenie kosztów

    Obsługa dostawców takich jak AWS Bedrock jest krokiem w kierunku bardziej agnostycznej platformy AI. Codex 0.125.0 może korzystać z modeli dostępnych w ramach danego konta AWS. To kluczowe dla firm korzystających z różnych dostawców modeli — Codex 0.125.0 może automatycznie wybrać najbardziej odpowiedni model dla zadania.

    W kontekście DevOps i observability, śledzenie zużycia tokenów poprzez CLI jest nowością wprowadzoną w Codex 0.125.0. Tokeny są często związane z bardziej złożonymi, kosztownymi operacjami modelu. Deweloper może teraz, korzystając z codex exec --json, otrzymać raport zużycia tych tokenów. To umożliwia audytowanie kosztów AI pipeline, przypisanie tokenów do konkretnych zadań i lepsze zarządzanie budżetem dla projektów wykorzystujących Codex 0.125.0 na dużą skalę.

    Stabilność i poprawki dla Windows

    Wydanie nie koncentruje się tylko na nowych funkcjach. Wprowadzono także szereg poprawek stabilności, które mają znaczenie dla codziennej pracy. Windows sandbox startup został poprawiony, co powinno zredukować problemy z uruchamianiem Codex 0.125.0 w środowiskach Windows. Dla deweloperów korzystających z Codex 0.125.0 na Windows lub w hybrydowych środowiskach (Windows/Linux) to istotna poprawka.

    Ulepszono również obsługę profili uprawnień w sesjach TUI (Terminal User Interface). Profile uprawnień są teraz bardziej konsekwentnie przenoszone między sesjami, interakcjami użytkownika, stanami sandboxa MCP oraz API app-server. To poprawia bezpieczeństwo i spójność w zarządzaniu dostępem agenta do zasobów systemowych.

    Wnioski i znaczenie dla web development oraz DevOps

    Wydanie Codex 0.125.0 pokazuje, że OpenAI rozwija swoją platformę AI coding assistant nie tylko jako narzędzie dla indywidualnych deweloperów, ale także jako system integracyjny dla zespołów i złożonych środowisk. Ulepszone zarządzanie środowiskami oraz obsługa AWS Bedrock wskazują, że Codex 0.125.0 przygotowuje się do roli centrum orchestracji AI workflowów w lokalnych i kontenerowych środowiskach developmentowych.

    • Obsługa AWS Bedrock otwiera drogę do bardziej dynamicznego i agnostycznego wykorzystania modeli AI w projektach.

    Źródła