Autor: Frontendfreak

  • Claude Code 2.1.139 wprowadza Agent View i autonomiczną komendę /goal — koniec z pilnowaniem AI

    Claude Code 2.1.139 wprowadza Agent View i autonomiczną komendę /goal — koniec z pilnowaniem AI

    Anthropic wprowadziło 11 maja 2026 roku aktualizację Claude Code 2.1.139, która zmienia sposób pracy z tym narzędziem. Z interfejsu czatu z funkcjami programistycznymi przekształca się w platformę orkiestracji agentów z pełnoprawnym kokpitem CLI. Najważniejsze nowości to Agent View, który umożliwia zarządzanie wieloma równoległymi sesjami, oraz komenda /goal, dzięki której Claude działa samodzielnie aż do spełnienia zadanego warunku.

    Kluczowe fakty

    • Agent View (claude agents) to dashboard CLI pokazujący wszystkie aktywne sesje z oznaczeniami statusów: working, blocked awaiting response oraz completed with pull request.
    • Komenda /goal ustawia warunek ukończenia zadania, a Claude działa autonomicznie przez wiele tur w trybie interaktywnym, -p oraz Remote Control.
    • Równoległość horyzontalna — Claude Code to pierwsze narzędzie CLI, które umożliwia jednoczesną pracę wielu agentów oraz nadzór w stylu menedżera sesji.
    • Sesje w tle działają niezależnie od terminala — proces supervisor zapewnia, że praca trwa nawet po zamknięciu okna.
    • Izolacja przez git worktree — każda równoległa sesja automatycznie dostaje własny worktree, co eliminuje konflikty.

    Agent View — kokpit zamiast czatu

    Nowy widok agentów to zmiana, która przekształca sposób interakcji z AI. Użytkownik nie rozmawia już z AI, lecz nadzoruje zespół agentów. W jednym widoku można zobaczyć wszystkie sesje: które aktywnie pracują, które czekają na odpowiedź użytkownika, a które już zakończyły pracę i wystawiły pull request.

    Użytkownik przestaje być inżynierem promptów i staje się kimś w rodzaju tech leada przeglądającego kolejkę PR-ów. Agent View wyświetla ikony semantyczne przy każdej sesji, co pozwala szybko zidentyfikować miejsca wymagające interwencji. Sesje w tle działają niezależnie od terminala, co oznacza, że proces supervisor na poziomie użytkownika utrzymuje agentów przy życiu, nawet gdy okno jest zamknięte.

    Anthropic opublikowało zrzut ekranu z 12 równoległymi sesjami śledzonymi w jednym widoku. Dla zespołów devopsowych to konkretna zmiana: można rozdzielić zadania między agentów i wrócić po pewnym czasie, aby sprawdzić, które sesje się zakończyły. Nie ma potrzeby "pilnowania".

    Wersja 2.1.139 dodała również claude agents --cwd <path>, aby zawęzić listę do konkretnego katalogu, co ułatwia zarządzanie przy wielu worktree.

    /goal — powiedz, co ma być zrobione, i zapomnij

    /goal — powiedz, co ma być zrobione, i zapomnij

    Komenda /goal to kluczowy element tej aktualizacji. Użytkownik definiuje warunek końcowy, na przykład "wszystkie testy przechodzą", "dokumentacja API wygenerowana" lub "wszystkie błędy z ESLinta poprawione", a Claude działa autonomicznie przez tyle tur, ile potrzebuje.

    Podczas pracy wyświetla się overlay z czasem, który upłynął, liczbą tur i zużyciem tokenów. /goal działa w trybie interaktywnym, w -p (tryb bez interakcji) oraz w Remote Control, co pozwala na uruchomienie agenta na zdalnej maszynie i zapomnienie o nim do momentu, gdy sam zgłosi wyniki.

    To zmiana, która przesuwa granice między "narzędziem" a "współpracownikiem". Nie chodzi już tylko o asystowanie przy kodowaniu, lecz o delegowanie całych zadań.

    Wydajność, stabilność i zarządzanie pluginami

    Wydajność, stabilność i zarządzanie pluginami

    Oprócz głównych nowości, wersja 2.1.139 wprowadza także wiele poprawek inżynieryjnych. Udoskonalono przewijanie w terminalu, zarządzanie pamięcią oraz kompatybilność międzyplatformową. Serwery MCP zyskały na wydajności, a zarządzanie pluginami stało się bardziej granularne.

    W sumie wydanie obejmuje 50 zmian, w tym nowe funkcje, poprawki i ulepszenia. Dodano również /scroll-speed do dostrajania przewijania, co, choć może wydawać się drobiazgiem, ma znaczenie przy długich sesjach.

    Co to oznacza dla web developmentu i devopsów

    Praktyczna konsekwencja jest taka, że zespoły mogą teraz efektywnie skalować pracę z AI. Jeden devops może nadzorować kilka agentów jednocześnie — każdy pracuje w izolowanym worktree, ma własny kontekst i nie koliduje z innymi. To już nie jest eksperymentalna funkcja do zabawy, lecz narzędzie do równoległego developmentu.

    Dla web developerów to szansa na automatyzację całych procesów: jeden agent refaktoruje komponenty, drugi aktualizuje testy, a trzeci generuje dokumentację. Wszystko odbywa się równolegle, z podglądem w czasie rzeczywistym. Nie trzeba już czekać na zakończenie jednego zadania, aby rozpocząć kolejne.


    Źródła

  • OpenCode v1.14.47: nowe skróty w TUI i trwalsze sesje agenta AI

    OpenCode v1.14.47: nowe skróty w TUI i trwalsze sesje agenta AI

    OpenCode doczekał się aktualizacji v1.14.47, która wprowadza kilka istotnych poprawek, zauważalnych dla każdego, kto spędza czas w terminalu. Zespół przywrócił znane skróty klawiszowe do edycji promptów oraz poprawił wyświetlanie ścieżek względnych, co wpływa na codzienną pracę użytkowników.

    Co nowego w skrócie

    • TUI przywraca klawisze do edycji promptów i wyświetla ścieżki w formie względnej
    • Persystencja modeli między sesjami stała się bardziej niezawodna — koniec z niespodziankami po restarcie
    • HTTP API lepiej radzi sobie z błędami, a Scout agent potrafi materializować repozytoria referencyjne
    • Duże załączniki graficzne są teraz automatycznie skalowane, co oszczędza zasoby

    TUI bliżej użytkownika

    Najważniejsza zmiana dotyczy interfejsu terminalowego. Przywrócono skróty klawiszowe do edycji promptów, co wcześniej mogło być irytujące, gdy użytkownik chciał szybko poprawić zapytanie bez użycia myszki. Teraz te funkcje są z powrotem dostępne.

    Kolejną poprawą jest renderowanie ścieżek względnych zamiast bezwzględnych. Oznacza to, że zamiast długich ścieżek, takich jak /home/user/projekty/aplikacja/src/components/..., użytkownicy zobaczą po prostu src/components/.... To ułatwia pracę, szczególnie przy głęboko zagnieżdżonych strukturach katalogów.

    Sesje, które nie gubią kontekstu

    Sesje, które nie gubią kontekstu

    Jeśli kiedykolwiek wróciłeś do przerwanej pracy i odkryłeś, że agent zapomniał, z jakiego modelu korzystał, wiesz, jak frustrujące to może być. Wersja v1.14.47 wprowadza lepszą persystencję modeli między sesjami. Agent teraz bardziej konsekwentnie zapamiętuje wybór, więc nie trzeba go konfigurować za każdym razem.

    Dodatkowo poprawiono obsługę błędów w HTTP API, co skutkuje mniejszą ilością niejasnych komunikatów i większą ilością konkretnych informacji, które pomagają w diagnozowaniu problemów. Scout agent, odpowiedzialny za przeszukiwanie zewnętrznych zasobów, zyskał zdolność materializowania repozytoriów referencyjnych, co oznacza, że może teraz pobierać i udostępniać kod z zewnętrznych źródeł.

    Automatyczne skalowanie obrazów

    Automatyczne skalowanie obrazów

    Wprowadzono również automatyczne zmienianie rozmiaru dużych załączników graficznych. Użytkownicy nie muszą już ręcznie zmniejszać screenshotów przed dodaniem ich do promptu — OpenCode zajmie się tym automatycznie, dbając o to, aby nie przekroczyć rozsądnych limitów. To małe udogodnienie oszczędza czas, zwłaszcza przy częstym korzystaniu z kontekstu wizualnego.

    Szerszy kontekst

    OpenCode to wciąż rozwijający się projekt open source, dostępny na macOS, Windows i Linux. Działa jako agent AI w terminalu, IDE lub jako samodzielna aplikacja desktopowa. Cykl wydawniczy jest szybki — nowe wersje pojawiają się co kilka dni, a każda z nich wprowadza zmiany w jednym z obszarów: Core, TUI, MCP lub Desktop.

    Analizując changelog z ostatnich tygodni, widać, że zespół nie zwalnia tempa. Wprowadzane są poprawki MCP, wsparcie dla nowych dostawców, optymalizacje wydajnościowe oraz usprawnienia desktopowe, co sprawia, że narzędzie staje się coraz bardziej konkurencyjne w stosunku do komercyjnych rozwiązań.

    Aktualizacja v1.14.47 nie jest rewolucyjna, ale takie przyrostowe zmiany — przywrócone skróty, czytelniejsze ścieżki, trwalsze sesje — mają kluczowe znaczenie dla komfortu korzystania z narzędzia.


    Źródła

  • Factory CLI v0.121.0: Wskaźnik czasu myślenia i szybsza nawigacja w terminalu

    Factory CLI v0.121.0: Wskaźnik czasu myślenia i szybsza nawigacja w terminalu

    Najnowsza aktualizacja Factory CLI do wersji v0.121.0 wprowadza dwie ważne zmiany w interfejsie użytkownika. Droidy teraz pokazują licznik czasu przetwarzania, a programiści mogą szybko przewijać sesję do ostatniego promptu. To wydanie koncentruje się na poprawie ergonomii pracy w długich, interaktywnych sesjach AI, co jest istotne w kontekście rosnącej popularności narzędzi do programowania z użyciem AI i agentowego developmentu.

    Kluczowe fakty o nowym wydaniu

    • Czas myślenia — CLI i aplikacja pokazują teraz, ile sekund droid spędził na analizie przed udzieleniem odpowiedzi.
    • Przewijanie do ostatniego promptu — użytkownik może jednym kliknięciem przeskoczyć do najnowszego polecenia w sesji.
    • Buforowane renderowanie transkryptu — interfejs ładuje zapis rozmowy z pamięci podręcznej, co przyspiesza responsywność.
    • Szybsze błędy konfiguracji — proces setupu kończy się natychmiast po wykryciu problemu, zamiast zmuszać użytkownika do czekania na porażkę.
    • Stabilność automatyzacji — łatka naprawia ponowne łączenie z komputerem, cykl życia wywołań narzędziowych oraz wklejanie dużych bloków tekstu.

    Dlaczego widoczność czasu myślenia ma znaczenie dla AI engineeringu

    Wskaźnik czasu myślenia to istotny element w agentowym programowaniu, gdzie droidy piszą kod, refaktoryzują bazy i debugują aplikacje. Każda sekunda opóźnienia wpływa na ocenę wydajności modelu. Użytkownicy Factory CLI zyskali wgląd w czas przetwarzania, co pozwala im porównywać czasy odpowiedzi między różnymi promptami i identyfikować momenty, gdy droid spędza zbyt dużo czasu na przemyśleniach.

    To funkcjonalność, która szybko staje się niezbędna. Deweloperzy pracujący w trybie pair programming z AI szybko przyzwyczają się do zerkania na ten wskaźnik, zwłaszcza podczas długich sesji, gdy kontekst transkryptu rośnie do kilkunastu tysięcy tokenów. W połączeniu z buforowanym renderowaniem transkryptu, użytkownicy doświadczają płynniejszej pracy.

    Buforowanie transkryptu i przewijanie — ergonomia na pierwszym miejscu

    Buforowanie transkryptu i przewijanie — ergonomia na pierwszym miejscu

    Długie sesje z agentem AI mają swoje wyzwania. Transkrypt rozmowy może osiągnąć setki linii tekstu, a ręczne szukanie ostatniego promptu przez scrollowanie było dotychczas irytującym problemem. Nowa funkcja przewijania rozwiązuje ten problem: jedno kliknięcie przenosi użytkownika na sam dół do najnowszej interakcji.

    Buforowane renderowanie transkryptu działa jako optymalizacja frontendu CLI. Zamiast przeliczać cały zapis rozmowy przy każdym odświeżeniu widoku, interfejs przechowuje gotowy snapshot w pamięci. Efekt to mniej migotania, szybsze przełączanie między widokami i lepsza wydajność na słabszych maszynach, co jest istotne dla użytkowników korzystających z Factory CLI na zdalnych serwerach przez SSH.

    Setup, który nie każe ci czekać

    Setup, który nie każe ci czekać

    Kolejna zmiana dotyczy procesu konfiguracji. Dotychczas setup — pierwsze uruchomienie, instalacja zależności, łączenie z kontem — mógł trwać długo, gdy coś szło nie tak. W wersji v0.121.0 Factory wprowadza szybszą ścieżkę niepowodzenia: jeżeli setup wykryje błąd na wczesnym etapie, natychmiast przerywa działanie i zwraca komunikat. To oszczędza frustracji, szczególnie nowym użytkownikom, którzy nie znają jeszcze wszystkich wymagań środowiskowych.

    Warto również wspomnieć o poprawkach stabilności. Wersja v0.121.0 naprawia trzy konkretne problemy: z wklejaniem dużych bloków tekstu, cyklem życia wywołań narzędziowych oraz automatycznym ponownym łączeniem z komputerem. Te poprawki pokazują, że zespół Factory nie tylko dodaje nowe funkcje, ale także dba o stabilność w rzeczywistych workflow.

    Co to oznacza dla ekosystemu narzędzi deweloperskich

    Factory CLI jest terminalowym agentem AI do budowania, debugowania i refaktoryzacji kodu. W porównaniu do konkurencyjnych rozwiązań, takich jak Claude Code, Cursor czy Windsurf, Factory stawia na pełną integrację z przepływem pracy w terminalu, bez potrzeby przełączania się do GUI. Aktualizacja v0.121.0 wpisuje się w szerszy trend: narzędzia AI dla deweloperów coraz mocniej akcentują obserwowalność działania agentów i ergonomię interfejsu tekstowego. W miarę jak sesje z AI stają się dłuższe i bardziej złożone, UX terminala staje się kluczowym elementem produktywności.


    Źródła

  • Cursor 3.3: Rewolucja w przeglądzie PR i równoległym budowaniu – nowa era pracy z kodem

    Cursor 3.3: Rewolucja w przeglądzie PR i równoległym budowaniu – nowa era pracy z kodem

    Najnowsza aktualizacja Cursor, znana jako „Cursor 3.3”, wprowadza istotne zmiany w środowisku programistycznym. Program nie tylko wspiera pisanie kodu, ale staje się centralnym punktem w cyklu życia oprogramowania. Użytkownicy zyskają wbudowany workflow do obsługi pull requestów oraz możliwość równoległego uruchamiania niezależnych zadań przez agentów. Usprawnienia są dostępne w ramach stopniowo wdrażanej aktualizacji i nie wymagają skomplikowanej konfiguracji – wiele z nich działa od razu po włączeniu nowej wersji edytora.

    Kluczowe nowości w najnowszym wydaniu

    • Obsługa PR-ów bez opuszczania Cursor – tworzenie, przeglądanie i scalanie pull requestów w jednym oknie.
    • Równoległe wykonywanie planów – Cursor identyfikuje niezależne części planu i uruchamia je jednocześnie przez asynchroniczne podagenty, zachowując kolejność tam, gdzie występują zależności.

    Przegląd PR bez opuszczania edytora

    Dla wielu programistów przeglądanie pull requestów wiąże się z ciągłym przełączaniem się między IDE a przeglądarką, co wymaga śledzenia wątków recenzji, komentarzy, historii commitów i drzewa plików w różnych zakładkach. Nowa wersja Cursor 3.3 eliminuje tę konieczność – okno agenta zyskało przestrzeń do zarządzania PR-ami. Użytkownicy mogą tworzyć, recenzować i scalać zgłoszenia bez odchodzenia od edytora. Dzięki temu kontekst kodu pozostaje nienaruszony, a programista nie musi przypominać sobie stanu projektu po powrocie z zewnętrznego narzędzia.

    Zespół rozwija ideę „end-to-end coding”, gdzie etapy pracy nad oprogramowaniem są coraz bardziej zintegrowane w jednym środowisku.

    Równoległe uruchamianie zadań

    Kolejną istotną zmianą jest możliwość równoczesnego wykonywania niezależnych części planu. Zamiast czekać na przetworzenie jednego zadania po drugim, użytkownicy mogą teraz zlecić Cursorowi identyfikację fragmentów, które nie są ze sobą powiązane, i ich równoległe uruchomienie. Edytor wykorzystuje asynchroniczne podagenty, operujące na izolowanych git worktrees. Jeśli jakieś kroki muszą być wykonane sekwencyjnie (np. kompilacja przed testami), Cursor zachowa odpowiednią kolejność.

    To oznacza znaczące skrócenie czasu oczekiwania na wyniki. Deweloperzy korzystający z intensywnego generowania kodu przez AI mogą teraz zlecać wiele współbieżnych zadań i obserwować ich postęp w jednym oknie. Jak podają twórcy, wystarczy kliknąć „Build in Parallel”, aby zidentyfikować niezależne części planu i uruchomić je jednocześnie, zachowując kolejność kroków, które muszą być wykonane w odpowiedniej sekwencji.

    Inne usprawnienia

    Oprócz głównych nowości, Cursor 3.3 wprowadza również szereg mniejszych zmian, takich jak Design Mode oraz udoskonalenia w pracy z przeglądarką. To pokazuje, że edytor rozwija się w różnych kierunkach – od interfejsu użytkownika po backendowe mechanizmy współbieżności.

    Co to oznacza dla codziennej pracy programisty?

    Kumulacja tych nowości ma na celu zacieśnienie integracji edytora z całym cyklem wytwarzania oprogramowania. Obsługa PR-ów w tym samym oknie eliminuje konieczność przełączania kontekstu i utrzymuje ciągłość myślenia. Równoległe uruchamianie zadań lepiej wykorzystuje moc obliczeniową i skraca czas oczekiwania. Dla zespołów webowych, które coraz częściej sięgają po AI, Cursor oferuje płynniejszy przepływ od pomysłu do wdrożenia, zachowując kontrolę programisty na każdym etapie.

    Nowe funkcje są już dostępne w ramach aktualizacji i nie wymagają dodatkowej subskrypcji ani skomplikowanej konfiguracji – wystarczy uruchomić najnowszą wersję Cursor. W obliczu rosnącej złożoności projektów i presji na szybkie dostarczanie oprogramowania, takie narzędzia stają się nieodzownym elementem nowoczesnego warsztatu.


    Źródła

  • Windsurf Editor 2.2.17: Devin integruje się jeszcze głębiej, a wydajność zyskuje nowy blask

    Windsurf Editor 2.2.17: Devin integruje się jeszcze głębiej, a wydajność zyskuje nowy blask

    Czerwcowa aktualizacja Windsurf Editor w wersji 2.2.17 to kolejny krok w rebrandingu znanego środowiska programistycznego na Devin Desktop. Zmiana dotyczy jedynie nazwy, a nie funkcjonalności. Twórcy z Cognition skoncentrowali się na usprawnieniach interfejsu Agent Command Center, wprowadzeniu lokalnego agenta Devin Local oraz poprawkach stabilności, szczególnie dla użytkowników Windows.

    Kluczowe informacje o aktualizacji

    • Devin Local – agent działa teraz lokalnie w terminalu, oferując do 30% większą wydajność tokenową w porównaniu do Cascade, według przeprowadzonych testów.
    • Agent Command Center – odświeżony interfejs z widokiem Spaces, tablicą Kanban i zarządzaniem wieloma agentami.
    • Poprawki dla Windows – naprawiono błąd związany z tworzeniem sesji terminala na systemie Windows.
    • Stabilność agenta lokalnego – zwiększono niezawodność Devin Local oraz naprawiono usterki w integracji z serwerami MCP.

    Devin Local – agent teraz na twoim komputerze

    Nowością w tej wersji jest agent Devin Local, który działa bezpośrednio w terminalu użytkownika. Zgodnie z oficjalnym changelogiem, nowy agent jest nawet do 30% bardziej wydajny tokenowo niż dotychczasowy agent Cascade. Dzięki temu lokalne sesje stają się szybsze i mniej obciążają zasoby, co jest istotne, zwłaszcza przy pracy na słabszych maszynach. To rozwiązanie przybliża możliwości chmurowego Devina do środowiska lokalnego, eliminując potrzebę stałego połączenia z serwerami.

    Nowy wygląd skrzynki agenta – Spaces i Kanban

    Wraz z wersją 2.2.17 interfejs Agent Command Center został odświeżony. Wprowadzono widok Spaces, który pozwala lepiej organizować pracę nad różnymi projektami, oraz tablicę Kanban do wizualnego zarządzania zadaniami. Dodano także możliwość zarządzania wieloma agentami jednocześnie, co ułatwia koordynację pracy zespołowej i przełączanie się między zadaniami.

    Poprawki dla Windows – koniec z problemami terminala

    Aktualizacja 2.2.17 przynosi ważną poprawkę dla użytkowników systemu Windows, którzy doświadczali problemów z uruchamianiem sesji terminala. Błąd ten został naprawiony, co zapewnia płynniejszą pracę z agentami na tym systemie. To krok w kierunku lepszego wsparcia dla platformy Windows.

    Stabilność i wydajność – mniej błędów, szybciej

    Stabilność i wydajność – mniej błędów, szybciej

    Obszerny blok poprawek dotyczy również ogólnej stabilności. Naprawiono błędy w integracji z niektórymi serwerami MCP (Model Context Protocol), co wpłynie korzystnie na współpracę z zewnętrznymi narzędziami i bazami wiedzy. Znacznie poprawiono również niezawodność agenta Devin Local, który oferuje do 30% większą wydajność tokenową w porównaniu do wcześniejszego agenta Cascade. Sesje lokalne są teraz mniej podatne na niespodziewane przerwania, a czas ich ładowania został skrócony.

    Co ta aktualizacja oznacza dla całego ekosystemu?

    Wersja 2.2.17 wpisuje się w proces zmiany nazwy Windsurf na Devin Desktop, mający na celu ujednolicenie marki. Nowe funkcje, takie jak Devin Local i ulepszony Agent Command Center, pokazują, że Cognition konsekwentnie rozwija możliwości agentów, nie zmieniając przy tym samej natury narzędzia.


    Źródła

  • Codex 0.128.0: Trwałe przepływy pracy i większa kontrola nad agentami AI

    Codex 0.128.0: Trwałe przepływy pracy i większa kontrola nad agentami AI

    OpenAI opublikowało wersję 0.128.0 narzędzia Codex, która wprowadza nowe funkcje skupiające się na trwałych przepływach pracy, zarządzaniu wtyczkami oraz bardziej szczegółowych profilach uprawnień. Dla zespołów korzystających z agentowego programowania ta aktualizacja znacząco skraca czas rozruchu i ułatwia prowadzenie długotrwałych sesji.

    Najważniejsze zmiany

    • Trwałe przepływy pracy /goal można teraz zapisywać i przywracać zarówno z poziomu TUI, jak i przez API serwera aplikacji.
    • Zarządzanie wtyczkami zostało ulepszone, co zapewnia większą kontrolę nad aktywnymi rozszerzeniami w danej sesji.
    • Rozszerzone profile uprawnień pozwalają precyzyjniej określić, do czego Codex ma dostęp, minimalizując ryzyko.
    • Ulepszona konfiguracja MultiAgentV2 ułatwia orkiestrację równoległych agentów pracujących w tym samym repozytorium.
    • Import zewnętrznych sesji agentów umożliwia łatwe przenoszenie pracy rozpoczętej poza Codexem.

    Trwałe przepływy pracy /goal z pełną kontrolą

    To kluczowy element tej aktualizacji. Dotychczas agent mógł realizować cele, ale po zakończeniu sesji zapamiętanie, na czym stanął, wymagało ręcznego opisywania. W wersji 0.128.0 wprowadzono możliwość zapisywania stanu przepływów /goal. Umożliwia to powrót do przerwanego zadania, a Codex automatycznie wie, co zostało już zrobione, bez potrzeby ponownego definiowania kontekstu.

    Zarządzanie tymi przepływami jest dostępne zarówno przez tekstowy interfejs użytkownika (TUI), jak i przez API serwera aplikacji. Dla specjalistów DevOps oznacza to możliwość automatyzacji – scenariusze utrwalonego celu można uruchamiać zdalnie, bez konieczności interakcji przez konsolę. Takie podejście wspiera ideę vibe codingu: mniej klikania, więcej swobodnego definiowania kierunku pracy, podczas gdy agent pamięta o dotychczasowych ustaleniach.

    Lepsze wtyczki i rozszerzone uprawnienia

    Lepsze wtyczki i rozszerzone uprawnienia

    Nowa wersja poprawia również mechanizmy zarządzania wtyczkami. Oprócz szybszego ładowania, zaktualizowany system daje programistom lepszy wgląd w aktywne rozszerzenia i ich wpływ na działanie Codexa. Dla zespołów pracujących na wspólnych repozytoriach oznacza to mniej niespodzianek, takich jak różnice w działaniu na różnych maszynach.

    Rozszerzone profile uprawnień wprowadzają jeszcze większą kontrolę. Można teraz określić, że agent w danej sesji może czytać pliki, ale nie ma możliwości ich modyfikacji, albo że ma dostęp tylko do wybranych katalogów. To istotne w środowiskach hostingowych i DevOps, gdzie przypadkowa zmiana konfiguracji może prowadzić do problemów. Bezpieczeństwo nie spowalnia pracy, a raczej ją organizuje.

    MultiAgentV2 i import sesji zewnętrznych agentów

    Dla osób pracujących z wieloma agentami jednocześnie istotne są zmiany w konfiguracji MultiAgentV2. Codex od dawna umożliwiał równoległe działanie agentów, ale teraz łatwiej je ze sobą zgrać, szczególnie gdy pracują na różnych gałęziach tego samego repozytorium. Wbudowane wsparcie dla worktrees pozwala uniknąć konfliktów, dzięki czemu każdy agent ma swój własny piaskownik bez ryzyka nadpisywania zmian innych.

    Nowością jest także możliwość importowania sesji zewnętrznych agentów. Jeśli rozpocząłeś pracę w innym narzędziu lub otrzymałeś fragment konwersacji agentowej, możesz teraz łatwo wciągnąć to do Codexa i kontynuować bez utraty kontekstu. To znacząca wygoda, zwłaszcza podczas testowania różnych środowisk, gdy nie chce się zaczynać wszystkiego od nowa.


    Źródła

  • Factory CLI z transmisją na żywo i masową kontrolą limitów

    Factory CLI z transmisją na żywo i masową kontrolą limitów

    Factory wydało 9 czerwca 2025 roku wersję v0.118.0 swojego Factory CLI, wprowadzając kilka istotnych usprawnień dla programistów oraz administratorów. Najważniejszą nowością jest transmisja na żywo w aplikacji desktopowej, która umożliwia użytkownikom śledzenie myślenia droidów w czasie rzeczywistym, co eliminuje potrzebę czekania na zakończenie całego zadania. Dodatkowo wprowadzono masowe aktualizacje limitów oraz rozszerzone wsparcie językowe.

    Co nowego w Factory CLI v0.118.0

    • Live streaming w aplikacji desktopowej pokazuje cząstkowe wyniki tekstowe i proces myślowy droidów przed zakończeniem zadania.
    • Masowa aktualizacja limitów pozwala administratorom zmieniać ustawienia wielu kont jednocześnie, co oszczędza czas i redukuje ryzyko błędów.
    • Lokalizacja wyników przeglądu umożliwia korzystanie z narzędzia przez użytkowników spoza anglojęzycznego rynku oraz dostosowuje workflow do lokalnych potrzeb.
    • Poprawki błędów eliminują problemy z odzyskiwaniem sesji i zapewniają spójne działanie persona w Slacku.

    Transmisja na żywo – podgląd pracy droidów w czasie rzeczywistym

    Dotychczas użytkownicy Factory widzieli jedynie końcowy efekt działania droidów. Po aktualizacji aplikacja streamuje częściowe aktualizacje tekstu oraz proces myślowy agenta AI w trakcie wykonywania zadania. Dla programistów oznacza to większą przejrzystość – mogą na bieżąco oceniać, czy droid zmierza w dobrym kierunku, i szybciej identyfikować błędy w rozumowaniu.

    Transmisja na żywo zmienia również sposób pracy z narzędziem. Zamiast czekać na wynik, deweloper ma wgląd w iteracyjne decyzje agenta. Jest to szczególnie istotne przy dłuższych zadaniach, takich jak generowanie kodu, refaktoryzacja czy debugowanie, gdzie pośrednie kroki wpływają na jakość końcowego rozwiązania. Funkcja ta jest obecnie dostępna tylko w aplikacji desktopowej, co warto uwzględnić przy planowaniu workflow.

    Masowe zarządzanie limitami – ukłon w stronę administratorów

    Masowe zarządzanie limitami – ukłon w stronę administratorów

    Drugą istotną zmianą w v0.118.0 są masowe aktualizacje limitów, które umożliwiają aktualizację limitów dla grup użytkowników w jednym kroku. Wcześniej administratorzy musieli ręcznie konfigurować każde konto, co przy większej liczbie deweloperów wiązało się z dużą ilością pracy i ryzykiem błędów. Teraz wystarczy zaznaczyć odpowiednich użytkowników i ustawić limity hurtowo.

    Factory kieruje tę funkcję do większych zespołów i klientów enterprise. Masowe operacje na kontach wskazują na rozwój platformy jako narzędzia do zarządzania AI w organizacji. Podczas onboardingu nowych pracowników czy rotacji w zespołach taka funkcjonalność oszczędza czas administratorów i zapewnia spójność przydziałów, co jest istotne dla efektywnego zarządzania.

    Lokalizacja, stabilność i spójność w Slacku

    Lokalizacja, stabilność i spójność w Slacku

    Mniej spektakularne, ale równie ważne są pozostałe zmiany. Wyniki przeglądów zostały zlokalizowane, co rozszerza wsparcie dla użytkowników nieanglojęzycznych oraz zespołów pracujących w regionach, gdzie angielski nie jest głównym językiem. To ważny krok w kierunku zwiększenia adopcji narzędzia poza rynkiem amerykańskim.

    Dodatkowo poprawiono kilka błędów. Odtwarzanie sesji działa teraz bardziej niezawodnie, a persona droidów zachowuje spójność niezależnie od tego, czy zespół korzysta z nich przez Slacka, aplikację desktopową, czy Factory CLI. Dla rozproszonych zespołów, które używają różnych kanałów komunikacji, ta spójność jest kluczowa, eliminując sytuacje, w których agent działa inaczej w zależności od interfejsu.

    Znaczenie dla codziennego workflow

    Factory pozycjonuje się jako agent inżynierii oprogramowania AI działający z poziomu terminala. Dla web developerów i zespołów DevOps każda z tych aktualizacji ma praktyczne znaczenie dla codziennej pracy. Transmisja na żywo ułatwia debugowanie złożonych zadań, masowe limity odciążają administratorów, a poprawki stabilności zwiększają niezawodność w dłuższych projektach.

    Interesujące jest połączenie transmisji na żywo z integracją Slack. Można sobie wyobrazić scenariusz, w którym deweloper zleca zadanie przez czat, obserwuje postępy w aplikacji desktopowej, a po zakończeniu otrzymuje spójny raport na Slacku. Factory skutecznie testuje granice między różnymi interfejsami.


    Źródła

  • Factory CLI v0.116.0: Narzędzia świadome kontekstu i inteligentniejszy onboarding

    Factory CLI v0.116.0: Narzędzia świadome kontekstu i inteligentniejszy onboarding

    Najnowsza aktualizacja narzędzia wiersza poleceń Factory, wersja v0.116.0, wprowadza znaczące zmiany dla zespołów pracujących w mieszanych środowiskach deweloperskich. Główne zmiany dotyczą narzędzia Execute, które teraz potrafi dostosować się do kontekstu wykonawczego. Rozpoznaje, czy działa w czystym Linuksie, czy w Windows Subsystem for Linux (WSL), i odpowiednio modyfikuje swoje podpowiedzi. Dodatkowo, zespół uprościł proces wdrażania nowych użytkowników, umożliwiając dodanie metody płatności bezpośrednio na ostatnim ekranie konfiguracji. Wprowadzono także system podpowiedzi gotowości, który ułatwia przechodzenie przez kolejne etapy pracy. Aktualizacja zawiera również poprawki błędów, w tym stabilniejsze działanie promptów po wznowieniu sesji oraz dokładniejszą klasyfikację problemów z rozliczeniami.

    Kluczowe fakty o wydaniu

    • Execute tool zyskuje świadomość środowiska uruchomieniowego i dostarcza wskazówek specyficznych dla WSL
    • Wykrywanie bashismów zostało rozszerzone, by chronić agentów przed cichymi awariami skryptów
    • Metoda płatności może być teraz dodana bezpośrednio podczas ostatniego kroku onboardingu
    • Readiness hints to nowe podpowiedzi, które usprawniają przechodzenie przez zadania w CLI
    • Poprawki błędów obejmują lepszą obsługę promptów po wznowieniu, niezawodniejsze rozumowanie Gemini i dokładniejszą klasyfikację błędów billingowych

    Execute tool z wyczuciem środowiska

    Narzędzie Execute jest kluczowym elementem Factory CLI, odpowiedzialnym za wykonywanie poleceń w terminalu i współpracę z agentami AI. Dotychczas jego komunikaty były jednakowe na różnych platformach, co prowadziło do frustracji, gdy agent sugerował komendy działające tylko w natywnym Linuksie, a użytkownik pracował w WSL. W wersji v0.116.0 Execute samodzielnie wykrywa środowisko i dostosowuje swoje porady.

    Gdy CLI działa w WSL, użytkownik otrzymuje instrukcje uwzględniające specyfikę tego subsystemu, takie jak ścieżki do systemu plików Windows, dostęp do sieci czy zgodność z dystrybucjami Linuxa dostępnymi w Microsoft Store. To ważne dla deweloperów, którzy często zmieniają środowiska pracy. Narzędzie dba o to, aby nie generować skryptów wymagających funkcji jądra niedostępnych w subsystemie.

    Rozbudowane wykrywanie bashismów wspiera tę funkcjonalność. Skrypt napisany dla Bashu może zawieść w czystym sh, Dashu czy Zsh, jeśli nie zawiera odpowiedniego shebangu. Execute teraz szybciej ostrzega przed konstrukcjami składniowymi, które mogą nie działać w bieżącym środowisku powłoki. Dzięki temu użytkownicy spędzają mniej czasu na debugowaniu i mają większą pewność, że zaproponowane rozwiązanie zadziała.

    Płatności w onboardingu i system podpowiedzi gotowości

    Proces rozpoczęcia pracy z Factory został znacząco uproszczony. Użytkownik wcześniej musiał przejść przez całą konfigurację, aby na końcu skonfigurować metodę płatności. Teraz można to zrobić na ostatnim ekranie onboardingu. Umożliwienie dodania karty kredytowej czy innej formy płatności w tym samym przepływie zwiększa konwersję z okresu próbnego na płatne korzystanie.

    Nowe readiness hints to system mikro-podpowiedzi, które informują użytkownika o gotowości środowiska do podjęcia kolejnych kroków. Mogą to być komunikaty informujące, że środowisko jest gotowe do wykonania konkretnej komendy lub że brakuje zależności, które należy zainstalować przed kontynuowaniem. To ułatwienie jest istotne dla nowych użytkowników, ale także dla doświadczonych deweloperów w skomplikowanych przepływach pracy.

    Gemini, promptowanie i stabilność

    W wersji v0.116.0 Factory CLI wprowadza także poprawki, które zwiększają niezawodność. Ulepszono obsługę promptów użytkownika po wznowieniu pracy, co wcześniej mogło prowadzić do nieprzewidzianych zachowań agenta. Teraz kontekst jest odtwarzany stabilniej. Rozumowanie Gemini, modelu AI od Google, zostało usprawnione w scenariuszach wieloetapowych, gdzie agent prowadzi dłuższe interakcje. Lepsza klasyfikacja błędów billingowych oznacza, że użytkownicy nie będą mylnie informowani o problemach z płatnościami, które dotyczą innych aspektów usługi.

    Dla zespołów intensywnie wykorzystujących terminalowe agenty AI, aktualizacja ta przynosi zauważalne korzyści w codziennej pracy.


    Źródła

  • OpenCode v1.14.33 łata krytyczny błąd z agentami we wtyczkach

    OpenCode v1.14.33 łata krytyczny błąd z agentami we wtyczkach

    Zespół OpenCode wydał wersję v1.14.33 swojego otwartoźródłowego agenta AI do kodowania. Aktualizacja koncentruje się na jednym istotnym poprawieniu — naprawia błąd, który uniemożliwiał poprawne ładowanie niestandardowych agentów w pluginach. Dla deweloperów korzystających z rozszerzeń, ta łatka jest kluczowa, ponieważ bez niej agenty nie działały.

    Co przynosi wydanie — najważniejsze fakty

    • OpenCode v1.14.33 naprawia błąd blokujący ładowanie customowych agentów w pluginach.
    • Aktualizacja ma charakter stabilizacyjny, nie wprowadza nowych funkcji.
    • Problem dotyczył przede wszystkim deweloperów używających rozszerzeń pluginowych w workflow.
    • Łatka wpisuje się w szerszy trend hartowania stabilności aplikacji w ostatnich wydaniach.

    Dlaczego ten fix jest ważny dla codziennej pracy

    OpenCode to narzędzie używane w terminalu, IDE i na desktopie. Jeśli polegasz na pluginach rozszerzających możliwości agenta — w kontekście web developmentu, devopsów czy zadań związanych z AI — niedziałający agent to poważna przeszkoda. To blokada całego workflow.

    Wydanie v1.14.33 eliminuje sytuację, w której customowy agent skonfigurowany w pluginie nie pojawiał się. Problem nie wynikał z błędów konfiguracyjnych po stronie użytkownika, lecz z samego mechanizmu ładowania agentów przez rdzeń aplikacji. W praktyce oznaczało to, że plugin istniał, był widoczny, ale jego główna funkcjonalność nie działała.

    Co ważne, poprawka obejmuje również poboczne problemy z zależnościami. Z changeloga wynika, że deweloperzy OpenCode poprawili nie tylko samo ładowanie, ale także kwestie związane z zarządzaniem zależnościami w kontekście pluginów. To sugeruje, że źródło błędu mogło być głębsze niż zwykła pomyłka w kodzie — prawdopodobnie chodziło o nieprawidłową kolejność inicjalizacji komponentów.

    Kontekst szerszych poprawek w ekosystemie OpenCode

    Kontekst szerszych poprawek w ekosystemie OpenCode

    Wydanie v1.14.33 nie jest odosobnione. Przegląd changeloga z ostatnich dni pokazuje, że zespół konsekwentnie pracuje nad stabilnością rdzenia. Wcześniejsze aktualizacje z tego samego cyklu przyniosły m.in. poprawki w obsłudze zakładek w desktopie, ulepszenia wieloserwerowej architektury, poprawki dla sesji i widoków uprawnień, a także usprawnienia w odświeżaniu stanu sesji.

    Widać wyraźny wzorzec — OpenCode dojrzewa jako narzędzie dla profesjonalistów. Zamiast gonić za nowymi efektownymi funkcjami, zespół inwestuje czas w to, co naprawdę ma znaczenie w codziennej pracy: niezawodność. Agent AI do kodowania, który działa sporadycznie, jest bezużyteczny — szczególnie gdy jest częścią zautomatyzowanego pipeline'u.

    Wersja v1.14.33 pokazuje, jak istotna jest architektura pluginowa w nowoczesnych narzędziach deweloperskich. OpenCode od początku stawiał na rozszerzalność. Jeśli jednak fundament — czyli mechanizm ładowania agentów — nie działa, cała filozofia "zainstaluj i rozszerz" traci sens. Ta łatka przywraca ten fundament.

    Co zrobić po aktualizacji

    Co zrobić po aktualizacji

    Jeśli korzystasz z OpenCode i masz skonfigurowane własne agenty w pluginach, po aktualizacji do v1.14.33 powinieneś zobaczyć je z powrotem na liście dostępnych. Nie są wymagane żadne dodatkowe kroki migracyjne — poprawka działa automatycznie po restarcie aplikacji.

    Warto również sprawdzić, czy wcześniejsze problemy z zależnościami pluginów ustąpiły. Jeśli któryś z twoich pluginów wymagał konkretnych bibliotek i wcześniej nie działał, istnieje duża szansa, że teraz załaduje się poprawnie. Zespół OpenCode nie opublikował osobnej dokumentacji migracyjnej dla tego wydania, ponieważ nie jest ona potrzebna. To czysta łatka stabilizacyjna.

    Deweloperzy, którzy jeszcze nie aktualizowali, mogą pobrać nową wersję bezpośrednio z repozytorium GitHub projektu lub przez menedżer pakietów. Standardowa komenda opencode update również powinna zadziałać.

    Podsumowanie

    v1.14.33 nie jest wydaniem, które przyciągnie uwagę mediów. Nie zawiera nowych modeli AI, przełomowych integracji ani przeprojektowanego UI. Jest za to coś znacznie ważniejszego dla użytkowników OpenCode — pewność, że ich agenty się załadują. W świecie narzędzi deweloperskich stabilność bywa niedoceniana, aż do momentu, gdy jej zabraknie. Zespół OpenCode zdaje się to rozumieć.


    Źródła

  • Codex 0.128.0: Praca nad kodem nie kończy się po zamknięciu terminala

    Codex 0.128.0: Praca nad kodem nie kończy się po zamknięciu terminala

    Wydanie OpenAI Codex 0.128.0 przesuwa fokus z krótkich interakcji na długotrwałe, autonomiczne zadania programistyczne. Nowe mechanizmy zarządzania celami, rozszerzona kontrola uprawnień oraz usprawniony system wtyczek sprawiają, że asystent staje się środowiskiem pracy, które może kontynuować implementację nawet w nieobecności programisty. To nie tylko kosmetyczna zmiana, ale istotny krok w kierunku traktowania Codexa jako agenta zdolnego do długich sesji, a nie tylko interaktywnego edytora.

    Kluczowe fakty o wydaniu

    • Trwałe cele /goal – cel zdefiniowany przez użytkownika jest przechowywany między sesjami; Codex potrafi wznowić pracę i raportować postępy samodzielnie.
    • Rozszerzone profile uprawnień – precyzyjniejsza kontrola nad tym, co agent może robić bez pytania, co jest kluczowe w środowiskach produkcyjnych i DevOps.
    • Usprawniony ekosystem wtyczek – instalacja z marketplace oraz zdalne cache'owanie paczek przyspieszają konfigurację i ponowne użycie narzędzi.
    • Jawna konfiguracja MultiAgentV2 – lepsze sterowanie podziałem zadań między agentami i ich współpracą w długich przepływach pracy.
    • Poprawki stabilności – rozwiązano błędy w terminalu (TUI), zachowaniu sieci i Windows Sandbox, co docenią zespoły pracujące zdalnie i w kontenerach.

    Cele, które nie znikają po zamknięciu terminala

    Nowością w tej wersji jest mechanizm trwałego celu. Wcześniej komendy w Codexie działały jak pojedyncze polecenia: wydawałeś komendę, otrzymywałeś wynik, a kontekst znikał. W wersji 0.128.0 komenda /goal jest podłączona do API serwera aplikacji, narzędzi modelowych i kontrolek TUI. Cel zostaje zapisany, a agent może do niego wracać, kontynuować pracę i raportować postępy nawet po przerwach – bez potrzeby ponownego tłumaczenia całego zadania.

    Oznacza to, że programista może zlecić złożone zadanie (np. „zrefaktoryzuj moduł płatności i dodaj testy integracyjne”), zamknąć terminal i wrócić po pewnym czasie. Codex nie zacznie od nowa – zapamięta, na czym stanął, i będzie w stanie kontynuować pracę. To znaczący krok w kierunku agent workspace, gdzie narzędzie nie tylko edytuje pliki, ale także zarządza długofalowymi zadaniami inżynieryjnymi. Dla praktyków vibe codingu i szybkiego prototypowania ciągłość myśli nie zależy już od obecności człowieka przed ekranem.

    Bezpieczeństwo i kontrola: profile uprawnień wchodzą na wyższy poziom

    Bezpieczeństwo i kontrola: profile uprawnień wchodzą na wyższy poziom

    Wraz z autonomią rośnie znaczenie bezpieczeństwa. Codex 0.128.0 wprowadza rozbudowane profile uprawnień, które pozwalają precyzyjnie określić, które akcje agent może wykonywać bez pytania o zgodę – od operacji na plikach po wywołania sieciowe. Ma to szczególne znaczenie w środowiskach CI/CD, gdzie agent może automatycznie budować i testować kod, ale nie powinien bez nadzoru modyfikować krytycznych plików konfiguracyjnych lub zmiennych środowiskowych. Profile można dostosować do konkretnego repozytorium, a ich działanie obejmuje także kontekst sesji długotrwałych, co minimalizuje ryzyko nieautoryzowanego uruchomienia złośliwego kodu w tle.

    Wtyczki, które instalujesz raz i używasz wszędzie

    Kolejnym istotnym usprawnieniem jest nowy przepływ pracy z wtyczkami. Codex 0.128.0


    Źródła