Autor: Franczeska

  • Factory 0.115.0 wprowadza natywną obsługę PDF i ulepszenia CLI dla programistów

    Factory 0.115.0 wprowadza natywną obsługę PDF i ulepszenia CLI dla programistów

    Factory wydało wersję 0.115.0 swojej platformy deweloperskiej, a kluczową nowością jest natywna obsługa plików PDF przez model Gemini 3.1 Pro. Aktualizacja, dostępna od 5 czerwca 2026 roku, wprowadza także wsparcie dla zaawansowanego wnioskowania w GLM-5.1 oraz szereg poprawek stabilności, które będą przydatne dla osób pracujących z długimi sesjami agentowymi.

    Co nowego w Factory 0.115.0

    • Natywna obsługa PDF w Gemini 3.1 Pro — model może teraz bezpośrednio analizować dokumenty, specyfikacje i raporty bez wcześniejszego przetwarzania.
    • Wsparcie dla wnioskowania w GLM-5.1 otwiera nowe możliwości w złożonych zadaniach analitycznych.
    • Masowe przeciąganie obrazów w CLI przyspiesza pracę z multimodalami — szczególnie przydatne przy debugowaniu UI i analizie zrzutów ekranu.
    • Bezpośrednie przesyłanie PDF w aplikacji eliminuje tarcie między dokumentacją a workflow.
    • Ulepszona synchronizacja w chmurze i odporność sesji na przerwania sprawiają, że długie zadania agentowe nie gubią stanu.

    Gemini 3.1 Pro z natywnym PDF

    Google określa Gemini 3.1 Pro jako swój najbardziej zaawansowany model wnioskujący, zdolny do pracy z tekstem, dźwiękiem, obrazami, wideo i PDF-ami. Model oferuje okno kontekstowe o wielkości miliona tokenów na wejściu i 64 tysiące na wyjściu, co pozwala na przetwarzanie bardzo obszernych dokumentów technicznych w całości.

    Dla zespołów programistycznych oznacza to koniec z koniecznością konwersji dokumentów. Dokumentacja projektowa, logi serwerowe, specyfikacje API czy raporty z testów mogą trafiać prosto do modelu, bez potrzeby ręcznego wycinania fragmentów. Factory integruje tę funkcję na dwa sposoby: przez przeciągnięcie pliku w interfejsie aplikacji oraz przez bezpośrednie odwołanie w CLI.

    Gemini 3.1 Pro osiągnął wynik 77,1% w teście ARC-AGI-2, co Google opisuje jako ponad dwukrotnie lepszy rezultat od poprzednika. W praktyce przekłada się to na skuteczniejsze rozumienie złożonych instrukcji i lepsze radzenie sobie z wieloetapowymi zadaniami.

    GLM-5.1 i wnioskowanie krok po kroku

    Oprócz Gemini, Factory dodało także wsparcie dla modelu GLM-5.1 z funkcją rozumowania. Choć GLM nie jest tak szeroko omawiany jak modele Google'a, jego obecność w ekosystemie Factory pokazuje, że platforma stawia na różnorodność silników AI.

    Wnioskowanie krok po kroku przydaje się szczególnie przy analizie błędów, refaktoryzacji czy zadaniach wymagających logicznego wyprowadzenia rozwiązania. Model potrafi przeprowadzić użytkownika przez swój proces myślowy, co ułatwia weryfikację poprawności odpowiedzi.

    CLI i stabilność

    Factory nie zapomniało o jakości życia programistów. Masowe przeciąganie obrazów w CLI to drobiazg, ale przy pracy ze zrzutami ekranu czy mockupami interfejsów oszczędza czas. Wystarczy zaznaczyć kilka plików w eksploratorze i puścić je w terminal — resztę ogarnia Droid.

    Wprowadzono także poprawki renderowania terminala i niezawodności uwierzytelniania. Ulepszona synchronizacja w chmurze i możliwość wznowienia pracy od miejsca przerwania są istotne dla programistów, którzy doświadczyli utraty sesji w trakcie debugowania.

    Co to oznacza dla zespołów deweloperskich

    Natywna obsługa PDF-ów zmienia sposób, w jaki można integrować dokumentację z procesem developmentu. Zamiast trzymać specyfikacje w osobnym oknie i ręcznie przepisywać wymagania, wystarczy wrzucić plik do Factory i pozwolić modelowi działać. Dla zespołów pracujących w metodykach zwinnych, gdzie dokumentacja szybko się zmienia, to oszczędność czasu i mniejsze ryzyko przeoczeń.

    Wersja 0.115.0 to solidny krok naprzód w użyteczności. Factory łączy moc nowych modeli AI z przemyślanymi usprawnieniami workflow, co sprawia, że platforma pozostaje konkurencyjna na rynku narzędzi do AI-assisted development.


    Źródła

  • Codex 0.128.0 wprowadza trwałe workflow i daje agentom pamięć, której do tej pory brakowało

    Codex 0.128.0 wprowadza trwałe workflow i daje agentom pamięć, której do tej pory brakowało

    OpenAI wprowadziło aktualizację Codex 0.128.0, która wprowadza istotne zmiany w sposobie, w jaki agenci radzą sobie z długotrwałymi zadaniami. Najważniejszą nowością jest trwałe zarządzanie kontekstem, które umożliwia agentowi tworzenie, wstrzymywanie i wznawianie zadań. Dodatkowo, aktualizacja oferuje szersze możliwości kontroli dostępu, usprawnione zarządzanie wtyczkami oraz lepszą orkiestrację wielu agentów. Wprowadzone zmiany obejmują również nowe kontrolki w interfejsie terminalowym oraz poprawki stabilności.

    Co nowego w aktualizacji Codex 0.128.0 — najważniejsze fakty

    • Trwałe stany zadań — agent może wracać do wcześniej zdefiniowanych celów i kontynuować pracę po przerwie, korzystając z zapamiętanego kontekstu.
    • Większe możliwości kontroli uprawnień — więcej opcji określania, do czego agent ma dostęp w środowisku deweloperskim.
    • Usprawnione wtyczki — lepsza jakość integracji i obsługi wtyczek.
    • Udoskonalona praca z wieloma agentami — płynniejsza współpraca i konfiguracja agentów w złożonych workflow.
    • Poprawki stabilności Windows — zwiększona niezawodność sandboksa i przewidywalność działania.

    Zarządzanie kontekstem — agent pamięta, nad czym pracuje

    Dotychczas praca z agentem przypominała rozmowę z kimś, kto po każdym „dziękuję” zapomina, o czym była mowa. Aktualizacja wprowadza mechanizmy trwałego kontekstu, dzięki którym agent zachowuje świadomość celu między sesjami. Można przerwać pracę, sprawdzić status i wrócić do zadania bez potrzeby tłumaczenia wszystkiego od nowa.

    Technicznie chodzi o ponowne wykorzystywanie wątków, kompresję konwersacji i planowanie długich zadań. Kontekst nie jest już tylko jednorazowym promptem — agent może odtwarzać stan i kontynuować złożone zadania. Dla osób pracujących nad wieloetapowym refaktoringiem lub projektem UI rozłożonym na kilka sesji, to znacząca zmiana.

    Co ważne, kontekst potrafi przetrwać przełączanie między wątkami. Agent nie gubi wątku, gdy przechodzimy z jednego obszaru pracy do drugiego. To krok w stronę modelu, w którym agent działa jako operator stanowy, a nie bezmyślny wykonawca jednorazowych poleceń.

    Więcej kontroli, mniej niespodzianek — uprawnienia i wtyczki

    Rozszerzone możliwości kontroli uprawnień odpowiadają na realny problem: jak dać agentowi swobodę działania, nie otwierając wszystkich drzwi. Aktualizacja pozwala lepiej określić, do czego agent ma dostęp, co jest istotne dla zespołów DevOps i hostingowych, które chcą bezpieczniej korzystać z Codex 0.128.0 w środowiskach produkcyjnych.

    Zarządzanie wtyczkami również zostało poprawione. Lepsza obsługa wtyczek oznacza mniej błędów przy instalacji i stabilniejsze działanie rozszerzeń. Dla web developerów korzystających z Codex 0.128.0 jako asystenta przy kodzie frontendu czy backendu to oznacza mniej frustracji przy konfiguracji środowiska.

    Orkiestracja wielu agentów i TUI — wszystko pod kontrolą

    Współpraca agentów w jednym workflow doczekała się usprawnień, które ułatwiają zarządzanie ich rolami. Chodzi o to, aby agenty nie wchodziły sobie w drogę, a konfiguracja była bardziej przewidywalna. Dla osób eksperymentujących z vibe codingiem i uruchamiających kilka agentów równolegle, to różnica między chaosem a sensowną orkiestracją.

    Interfejs terminalowy także został ulepszony. Nowe kontrolki TUI ułatwiają zarządzanie długotrwałymi zadaniami — łatwiej sprawdzić status, wznowić przerwane zadanie czy wyczyścić niepotrzebny stan.

    Windows i stabilność — mniej awarii, więcej przewidywalności

    Aktualizacja eliminuje kilka irytujących błędów. Na Windowsie zwiększono stabilność sandboksa i poprawiono niezawodność dostawców modeli, co przekłada się na mniej przerw w pracy. Dla użytkowników tego systemu to odczuwalna zmiana w codziennym korzystaniu z narzędzia.

    Kontekst ma znaczenie — dlaczego to istotne dla web devu i AI

    Dla osób pracujących z kodem na co dzień ta aktualizacja niesie konkretną wartość. Trwałe zarządzanie kontekstem sprawdza się przy zadaniach, które nie kończą się na jednej sesji — refaktoringu, budowaniu komponentów, testowaniu. Agent, który pamięta cele, to mniej czasu na odtwarzanie stanu i więcej na faktyczną pracę.

    Z perspektywy rozwoju AI widać wyraźny kierunek: agenty przestają być narzędziami jednorazowych promptów i stają się operatorami zdolnymi do długoterminowej współpracy. Ta aktualizacja to kolejny krok w tę stronę.


    Źródła

  • Claude traci możliwość obsługi 1M tokenów – dotyczy to modeli Sonnet 4 i 4.5

    Claude traci możliwość obsługi 1M tokenów – dotyczy to modeli Sonnet 4 i 4.5

    Anthropic zakończyło wsparcie dla kontekstu o rozmiarze miliona tokenów w modelach Claude Sonnet 4 oraz Claude Sonnet 4.5. Od 30 kwietnia 2026 deweloperzy korzystający z tych wersji nie będą mogli wysyłać zapytań przekraczających standardowe 200 tysięcy tokenów. Próba wysłania większego promptu zakończy się błędem.

    Zmiana wymaga natychmiastowej reakcji zespołów technicznych. Jeśli wasze aplikacje opierają się na przetwarzaniu dużych bloków kodu źródłowego, pełnych repozytoriów czy złożonej dokumentacji, konieczne będzie przejście na nowsze modele. Anthropic przygotowało już ścieżkę migracji, która nie wiąże się z dodatkowymi opłatami.

    Najważniejsze informacje

    • Claude Sonnet 4 i 4.5 nie obsługują już okna 1M tokenów – zapytania powyżej 200k tokenów zwracają błąd
    • Claude Sonnet 4 i 4.5 to docelowe modele dla deweloperów potrzebujących dłuższego kontekstu
    • Claude Sonnet 4 i 4.5 oferują 1M tokenów domyślnie na API Claude, Amazon Bedrock i Vertex AI
    • Nagłówek beta context-1m-2025-08-07 został wycofany i nie działa na starszych modelach
    • Nowe modele nie wymagają żadnego nagłówka beta – dłuższe okno działa standardowo

    Dlaczego ta decyzja ma znaczenie

    W branży web developmentu, AI i DevOps umiejętność pracy z długim kontekstem jest kluczowa. Dotyczy to analizy wieloplikowych refaktoryzacji, debugowania rozproszonych systemów czy generowania dokumentacji pokrywającej setki plików jednocześnie. Narzędzia takie jak Claude Code umożliwiły przetwarzanie całych projektów w jednym zapytaniu.

    Ograniczenie do 200 tysięcy tokenów znacząco zmniejsza możliwości agentów AI. Nie można zmieścić dużej bazy kodu w tak wąskim oknie, co prowadzi do przerwania ciągłości pracy – kontekst między zapytaniami zostaje utracony, a model przestaje "rozumieć" architekturę całego projektu.

    Anthropic wprowadziło nowe modele, które oferują to samo okno 1M tokenów w stabilnej, ogólnie dostępnej formie – bez eksperymentalnych nagłówków. Cena pozostała na tym samym poziomie.

    Co zmienia się operacyjnie

    Co zmienia się operacyjnie

    Stare zapytania przestaną działać. Jeśli wasze pipeline'y CI/CD, agenci vibe codingu czy asystenci kodowania opierają się na modelach Sonnet 4 lub 4.5, napotkacie błąd przy próbie przesłania promptu >200k tokenów. To nie jest subtelna zmiana – to twarde ograniczenie.

    Deweloperzy powinni natychmiast zaktualizować konfiguracje API, wskazując claude-sonnet-4 lub claude-sonnet-4.5 jako domyślny model. Te same modele oferują również 1M tokenów na platformach trzecich – Amazon Bedrock, Vertex AI – co ułatwia pracę zespołom korzystającym z chmury.

    Na nowszych modelach (Claude Sonnet 4 i 4.5) API może zatrzymać generowanie, gdy suma tokenów wejściowych i max_tokens przekroczy rozmiar okna. Otrzymacie wtedy stop_reason: "model_context_window_exceeded", ale samo żądanie nie zostanie odrzucone – to istotny detal dla każdego, kto buduje złożone przepływy agentowe.

    Migracja krok po kroku

    Migracja krok po kroku

    Przejście na nowe modele jest proste. Nie trzeba zmieniać struktury promptów ani logiki aplikacji. Wystarczy podmienić ID modelu w wywołaniu API. Nowe modele nie potrzebują już nagłówka beta – okno 1M tokenów działa domyślnie w standardowym modelu cenowym.

    Dla zespołów korzystających z Claude Code czy innych narzędzi, Anthropic zaleca natychmiastowe przejście na wyższe wersje modeli Sonnet 4 i 4.5. Dotyczy to zwłaszcza długotrwałych sesji debugowania czy scenariuszy związanych z rozległymi refaktoryzacjami.

    Podsumowanie

    Anthropic wygasza eksperymentalny dostęp do długiego kontekstu i przenosi go do głównego nurtu swoich modeli. 1M tokenów staje się standardem. Dla branży web developmentu, AI i DevOps to istotna zmiana: można planować architekturę aplikacji, wiedząc, że długie konteksty będą obsługiwane na produkcji. Dla osób pracujących z kodem na co dzień to zachowanie ciągłości pracy – bez niespodzianek przy następnym git push.


    Źródła

  • Sites – buduj i wdrażaj hostowane strony prosto z Codex

    Sites – buduj i wdrażaj hostowane strony prosto z Codex

    OpenAI wprowadziło wtyczkę Sites dla Codex, która umożliwia tworzenie, zapisywanie, wdrażanie i monitorowanie działających stron internetowych, aplikacji webowych oraz gier bez konieczności opuszczania środowiska agenta AI. Dzięki tej wtyczce pomysł opisany w prompcie może w ciągu kilku minut przekształcić się w w pełni hostowaną witrynę, eliminując potrzebę ręcznej konfiguracji serwera czy procesu CI/CD.

    Kluczowe informacje

    • Tworzenie i wdrażanie – wtyczka pozwala na budowę, zapis i publikację stron bez ręcznej konfiguracji hostingu.
    • Dostępność – dostępna w aplikacji Codex.
    • Bezpieczeństwo – OpenAI zaleca weryfikację zmian w kodzie, migracji bazy danych oraz odpowiednie zarządzanie sekretami.
    • Integracja z Codex – wtyczka działa bezpośrednio w środowisku Codex.

    Jak wygląda praca z Sites od pomysłu do produkcji

    Cały proces został zaprojektowany, aby maksymalnie skrócić czas od koncepcji do aktywnego URL. Po dodaniu wtyczki z katalogu Codex wystarczy opisać, co ma zostać stworzone. Codex generuje kod i może automatycznie sprawdzić, czy budowanie przebiegło pomyślnie.

    Następnie następuje kluczowy moment kontroli. Przed zapisaniem wersji gotowej do publikacji należy przejrzeć zmiany w plikach źródłowych oraz ewentualne migracje bazy danych. OpenAI podkreśla, aby nigdy nie przechowywać kluczy API ani haseł bezpośrednio w repozytorium – wszystkie tajemnice powinny być wprowadzane przez dedykowany interfejs wtyczki. Dopiero po tych krokach można zapisać wersję do wdrożenia lub od razu kliknąć deploy.

    Po publikacji warto sprawdzić status wdrożenia i potwierdzić docelowy adres URL, zanim zostanie on udostępniony. Całość odbywa się na hostingu OpenAI, co eliminuje potrzebę zakładania konta w zewnętrznym serwisie oraz modyfikacji ustawień DNS.

    Bezpieczeństwo i kontrola – nie tylko jednoklikowy magik

    Choć wtyczka Sites może wydawać się łatwym rozwiązaniem, OpenAI wyraźnie oddziela moment generowania kodu od bezpiecznego wdrożenia. Rekomendacje obejmują trzy warstwy: audyt kodu źródłowego, weryfikację poprawności migracji danych oraz odpowiednie zarządzanie sekretami środowiskowymi. Publikacja witryny jest możliwa dopiero po spełnieniu wszystkich warunków, a Codex zwraca publiczny link dopiero wtedy.

    Takie podejście ma na celu rozwiązanie jednego z największych problemów narzędzi AI – braku kontroli nad tym, co trafia na produkcję. Zamiast zgadywać, czy wygenerowany kod jest bezpieczny, programista ma wyraźny moment zatrzymania, zanim aplikacja zostanie udostępniona.

    Ekosystem rośnie – Sites wśród konkurencji

    Warto zauważyć, że Sites nie jest pierwszą wtyczką łączącą Codex z hostingiem. Pojawiają się informacje o integracjach z Netlify i Vercel, jednak szczegóły dotyczące konkretnych wtyczek i tagów nie zostały oficjalnie potwierdzone. Różnica polega na tym, że Sites to natywne rozwiązanie hostowane bezpośrednio przez OpenAI, co eliminuje potrzebę zakładania osobnego konta w zewnętrznej usłudze.

    Dla osób, które dopiero testują pomysł lub nie chcą zajmować się wyborem platformy hostingowej, wbudowane rozwiązanie może być znacznym ułatwieniem. Z kolei doświadczone zespoły mogą skorzystać z dedykowanych integracji z Netlify czy Vercel, gdy potrzebują większej kontroli nad konfiguracją.

    Co to oznacza dla programistów i vibe codingu

    Sites wpisuje się w trend łączenia generowania kodu z jego publikacją. Jeszcze rok temu przejście od swobodnego promptu do działającej aplikacji wymagałoby użycia kilku narzędzi. Teraz cały cykl – od opisu w języku naturalnym, przez budowę, audyt, aż po wdrożenie – może odbywać się w jednym oknie Codex.

    Dla osób zajmujących się tzw. vibe coding (prototypowanie bez głębokiej znajomości infrastruktury) to możliwość szybkiego pokazania efektów znajomym czy klientowi. Dla zespołów DevOps to sygnał, że granica między kodem a wdrożeniem staje się coraz cieńsza, a automatyzacja wkracza tam, gdzie wcześniej wymagana była ręczna praca. Trudno sobie wyobrazić powrót do czasów, gdy hosting konfigurowano z osobnej konsoli.

  • Claude Code 2.1.122: konfigurowalne poziomy usług Bedrock i inteligentniejsze wznawianie sesji

    Claude Code 2.1.122: konfigurowalne poziomy usług Bedrock i inteligentniejsze wznawianie sesji

    Anthropic wprowadziło aktualizację Claude Code 2.1.122, która dodaje zmienną środowiskową ANTHROPIC_BEDROCK_SERVICE_TIER do konfiguracji poziomów usług AWS Bedrock oraz poprawia mechanizm wznawiania sesji przez adresy URL pull requestów. To wydanie jest skierowane głównie do zespołów DevOps i deweloperów pracujących w regulowanych środowiskach, gdzie kontrola nad infrastrukturą jest kluczowa.

    Kluczowe zmiany w skrócie

    • ANTHROPIC_BEDROCK_SERVICE_TIER umożliwia wybór między default, flex a priority bez potrzeby modyfikacji kodu aplikacji.
    • Wznawianie sesji przez PR URL ułatwia odzyskiwanie kontekstu w długotrwałych zadaniach i przerywanych sesjach terminalowych.
    • Usprawnione logowanie OpenTelemetry zwiększa transparentność w agentowych workflow.
    • Poprawki stabilności obejmują m.in. fork branchy, resize obrazów i zachowanie powłoki terminala.

    Bedrock zyskuje warstwy usług – co to znaczy w praktyce

    Nowa zmienna ANTHROPIC_BEDROCK_SERVICE_TIER odpowiada na potrzeby zespołów korzystających z Claude'a przez AWS Bedrock. Wysłana jako nagłówek X-Amzn-Bedrock-Service-Tier, przyjmuje trzy wartości: default, flex oraz priority.

    Dzięki temu można dostosować zachowanie modelu na poziomie żądania – wybierając niższy priorytet dla zadań wsadowych lub wyższy dla interaktywnych sesji deweloperskich, gdzie opóźnienie jest szczególnie odczuwalne. Nie ma potrzeby zmiany kodu ani architektury – wystarczy ustawić zmienną środowiskową.

    Claude Code 2.1.122 został udostępniony w Bedrock z kontekstem 200 000 tokenów (około 150 000 słów, czyli ponad 500 stron tekstu), a integracja była od początku pozycjonowana jako rozwiązanie do budowy aplikacji gotowych do użycia w przedsiębiorstwie. Teraz zyskujesz dodatkową dźwignię operacyjną – idealną w środowiskach wielokontowych, gdzie różne zespoły mają różne wymagania dotyczące throughputu i kosztów.

    Wznawianie sesji przez PR – koniec zgadywania

    Wznawianie sesji przez PR – koniec zgadywania

    Każdy, kto spędził godziny na debugowaniu w terminalu, zna ten moment paniki: sesja się rozłącza, prompt znika, a Claude nagle nie pamięta, nad czym pracowałeś. Wydanie 2.1.122 rozwiązuje ten problem, umożliwiając znajdowanie sesji po adresie URL pull requesta.

    Mechanizm jest prosty, ale skuteczny. Jeśli prowadzisz długą sesję programistyczną powiązaną z konkretnym PR-em, możesz ją teraz łatwo odzyskać. To szczególnie istotne w scenariuszach, gdzie utrata kontekstu może znacznie obniżyć produktywność.

    Logowanie OpenTelemetry i poprawki infrastrukturalne

    Logowanie OpenTelemetry i poprawki infrastrukturalne

    Obserwowalność jest obecnie wymogiem. Rozszerzone logowanie OpenTelemetry w tej wersji daje lepszy wgląd w to, co robią agenci Claude'a – od wywołań narzędzi po decyzje klasyfikatora trybu auto.

    Dodatkowo Anthropic poprawiło kilka irytujących błędów. Udoskonalone zostało zachowanie przy fork branchy, gdzie wcześniej mogło dochodzić do niespójności. Naprawiono również resize obrazów w kontekście przetwarzania przez model oraz ujednolicono działanie powłoki terminala, co doceni każdy, kto miał problemy z różnymi emulatorami.

    Co to znaczy dla deweloperów

    Aktualizacja 2.1.122 nie wprowadza rewolucyjnych zmian, co jest pozytywne. To solidny zestaw ulepszeń, które eliminują problemy, z którymi deweloperzy borykali się od tygodni. Konfigurowalne poziomy Bedrock to korzyść dla zespołów dbających o koszty w AWS. Wznawianie sesji przez PR to z kolei udogodnienie dla tych, którzy pracują z Claude'em przez dłuższy czas i nie mogą sobie pozwolić na utratę kontekstu.

    Takie aktualizacje często są niedoceniane w świecie AI, gdzie uwaga skupia się na spektakularnych nowościach. Jednak to właśnie drobne poprawki w logowaniu, powłoce terminala i obsłudze nagłówków tworzą narzędzie, na którym można polegać w produkcji.

    Szczegóły techniczne i pełną listę zmian można znaleźć w oficjalnym changelogu Claude Code.


    Źródła

  • Kimi Code CLI 1.40.0: bezobsługowe działanie bez utraty kontroli nad agentem

    Kimi Code CLI 1.40.0: bezobsługowe działanie bez utraty kontroli nad agentem

    Wersja 1.40.0 terminalowego agenta kodowania Kimi Code CLI, wydana przez zespół MoonshotAI, wprowadza zmiany w sposobie kontroli nad trybami pracy bez nadzoru. Zamiast jednej, ogólnej flagi, dostępne są teraz niezależne przełączniki --yolo i --afk, co pozwala użytkownikom na precyzyjniejsze zarządzanie tym, co agent wykonuje samodzielnie, a co wymaga ich zgody.

    Co nowego w skrócie

    • Flagi --yolo i --afk — osobna automatyzacja uprawnień i osobny tryb pracy w tle
    • Ulepszone monitorowanie zadań w tle — odświeżony pasek statusu CLI wyraźniej pokazuje, co agent właśnie robi
    • Lepsze zarządzanie długotrwałymi sesjami — większa stabilność przy rozbudowanych refaktoryzacjach i debugowaniu
    • Poprawki w zarządzaniu sesjami OAuth — rzadsze utraty połączenia przy logowaniu przez przeglądarkę
    • Lepsze wykrywanie dostępnych umiejętności — agent szybciej odnajduje i wykorzystuje narzędzia

    Dlaczego podział na --yolo i --afk ma znaczenie

    Flaga --yolo w Kimi Code CLI odpowiada za automatyczne zatwierdzanie uprawnień, natomiast --afk umożliwia pracę w trybie bezobsługowym. Dzięki temu użytkownik może uruchomić agenta w tle i samodzielnie decydować, które operacje wymagają jego zgody, a które mogą być wykonywane automatycznie. To istotna zmiana, szczególnie w sytuacjach, gdy agent pracuje nad kodem przez dłuższy czas, a użytkownik sprawdza postępy sporadycznie. Nie ma potrzeby wybierania między pełną automatyzacją a całkowitym brakiem kontroli.

    Co zyskują długotrwałe sesje

    Praca agenta w nocy lub podczas dłuższych refaktoryzacji stała się bardziej komfortowa. Pasek statusu CLI, po odświeżeniu, wyraźniej pokazuje aktualny stan zadań w tle — użytkownik od razu widzi, czy agent utknął, czy przetwarza pliki, bez potrzeby ciągłego przeglądania logów. Dla osób korzystających z wielu terminali to znaczące ułatwienie. Ulepszenia w zarządzaniu długimi sesjami zmniejszają ryzyko wyczerpania zasobów w trakcie zadań — agent lepiej radzi sobie z iteracyjnym debugowaniem i generowaniem testów.

    Niezawodność sesji — usprawnienia w OAuth

    Stabilność sesji jest kluczowa, zwłaszcza przy logowaniu przez przeglądarkę. Wcześniejsze wersje Kimi Code CLI mogły tracić połączenie podczas dłuższej pracy, co było szczególnie problematyczne w nocnych pipeline’ach. Aktualizacja wprowadza poprawki w zarządzaniu sesjami OAuth, które zmniejszają ryzyko niespodziewanego przerwania pracy.

    Kimi Code CLI — szerszy kontekst

    Kimi Code CLI to terminalowy agent AI, który czyta i modyfikuje kod, wykonuje polecenia shella, przeszukuje pliki i planuje kolejne kroki na podstawie informacji zwrotnych. Wspiera interaktywny tryb CLI (kimi), interfejs przeglądarkowy (kimi web) oraz integracje z IDE przez protokół ACP.

    Aktualizacja 1.40.0 wpisuje się w szerszy trend oddzielania automatyzacji od polityki bezpieczeństwa, co można zauważyć również w innych narzędziach, takich jak Cursor czy Claude Code. Kimi Code CLI oferuje teraz narzędzia do bardziej szczegółowej kontroli: agent ma działać samodzielnie, ale nie bezmyślnie.


    Źródła

  • Claude Code 2.1.121 wprowadza opcję `alwaysLoad` dla MCP i poprawki stabilności

    Claude Code 2.1.121 wprowadza opcję `alwaysLoad` dla MCP i poprawki stabilności

    Anthropic wydało nową aktualizację swojego terminalowego asystenta kodowania — Claude Code 2.1.121. Ta wersja koncentruje się na poprawie konfiguracji serwerów MCP oraz rozwiązaniu istotnych problemów ze stabilnością i pamięcią. Jest to część regularnego cyklu aktualizacji, który przynosi usprawnienia interfejsu terminalowego i wydajności agenta.

    Kluczowe zmiany

    W tej wersji wprowadzono szereg ulepszeń, które mają na celu poprawę codziennego doświadczenia programistów. Usprawnienia obejmują zarządzanie pluginami, interakcję z terminalem oraz ogólną stabilność narzędzia podczas długich sesji.

    • Ulepszenia terminala: dialogi są teraz przewijalne (obsługują klawisze PgUp/PgDn, Home/End oraz scroll myszki), poprawiono działanie trybu pełnoekranowego oraz dodano pole wyszukiwania z filtrowaniem dla umiejętności.
    • Poprawa stabilności: wprowadzono poprawki, które rozwiązują problem niekontrolowanego wzrostu zużycia pamięci (unbounded memory growth) podczas przetwarzania obrazów oraz korzystania z /usage na dużych historiach sesji.
    • Lepsze zarządzanie pluginami: nowe narzędzia pomagają utrzymać czyste środowisko deweloperskie poprzez usuwanie nieużywanych zależności.

    Poprawa wydajności i stabilności długich sesji

    Naprawa problemów ze zużyciem pamięci jest kluczową zmianą w tej wersji. Wcześniejsze iteracje Claude Code 2.1.121 mogły doświadczać nieuzasadnionego wzrostu zużycia pamięci podczas pracy z dużą liczbą obrazów lub przy sprawdzaniu statystyk /usage w długich transkryptach. Dla deweloperów pracujących na VPS lub prowadzących długotrwałe sesje kodowania agenta, ta poprawka może znacząco zwiększyć stabilność i zredukować ryzyko nagłych awarii.

    Problem był szczególnie dotkliwy w scenariuszach intensywnego przetwarzania obrazów, co jest częste przy zadaniach związanych z dokumentacją, diagramami czy zrzutami ekranu debugowania. Nowa wersja wprowadza mechanizmy, które kontrolują ten wzrost, co powinno przynieść zauważalną poprawę w długoterminowych instancjach.

    Higiena pluginów i automatyzacja czyszczenia

    Nowe narzędzia odpowiadają na problem nagromadzenia zależności w środowiskach deweloperskich. Kiedy testowane są różne pluginy z marketplace, wiele z nich instaluje automatyczne zależności, które później pozostają nieużywane. Nowe funkcje identyfikują takie "osierocone" zależności i usuwają je, co pomaga utrzymać lekkość instalacji.

    To ważne dla zespołów, gdzie Claude Code 2.1.121 jest używany przez wiele osób na wspólnych maszynach, ponieważ pozwala zapobiegać bałaganowi w globalnych konfiguracjach.

    Dopracowanie interfejsu terminalowego dla codziennego workflow

    Anthropic kontynuuje poprawę UX w terminalu, co wskazuje na strategię optymalizacji Claude Code 2.1.121 dla coraz bardziej interaktywnych sesji deweloperskich. Przewijalne dialogi rozwiązują problem przepełnienia, gdy lista opcji lub wyników jest zbyt długa dla okna terminala. Lepsze działanie trybu pełnoekranowego, bez nagłego "skoku" pozycji przewijania podczas pisania, poprawia komfort pracy przy długich odpowiedziach modelu.

    Pole wyszukiwania z filtrowaniem dla umiejętności to kolejne udogodnienie, które umożliwia szybki dostęp. Wcześniej przeszukiwanie dostępnych umiejętności mogło być uciążliwe przy większej ich liczbie. Nowy mechanizm filtrowania pozwala szybciej znaleźć potrzebne narzędzie, co przyspiesza workflow w trybie kodowania agenta.

    Co to oznacza dla deweloperów i zespołów?

    To wydanie jest kolejnym krokiem w rozwoju Claude Code 2.1.121 jako narzędzia do kodowania z terminala, skoncentrowanego na agentach. Usprawnienia są skierowane do profesjonalnych użytkowników, którzy budują zaawansowane, zautomatyzowane workflow.

    Poprawy stabilności mają praktyczne znaczenie dla wdrożeń na serwerach, takich jak rozwój oparty na VPS, oraz dla każdego, kto prowadzi długie sesje z Claude. Lepsze zarządzanie pluginami zmniejsza obciążenie związane z utrzymaniem dla administratorów i deweloperów odpowiedzialnych za wspólne środowiska.

    W kontekście szybkiego cyklu wydań Claude Code 2.1.121, to wydanie pokazuje, że Anthropic koncentruje się nie tylko na dużych, nowych funkcjach, ale także na systematycznym dopracowywaniu podstaw: wydajności, stabilności i ergonomii codziennego użytkowania. To podejście buduje bardziej niezawodne i skalowalne narzędzie, które może obsługiwać coraz bardziej złożone zadania kodowania w realnych projektach.


    Źródła

  • OpenCode v1.14.26 naprawia konfigurację i wprowadza wsparcie dla edytora Zed

    OpenCode v1.14.26 naprawia konfigurację i wprowadza wsparcie dla edytora Zed

    Deweloperzy korzystający z terminalowego asystenta AI OpenCode otrzymali nową aktualizację, wersję 1.14.26, która wprowadza poprawki w parsowaniu konfiguracji, lepsze wsparcie dla modeli DeepSeek przez OpenRouter oraz szereg ulepszeń w terminalowym interfejsie użytkownika (TUI). Wydanie to koncentruje się na zwiększeniu niezawodności i integracji z narzędziami programistów.

    Najważniejszą zmianą w obszarze konfiguracji jest poprawka, która zapewnia zachowanie kolejności reguł uprawnień podczas scalania plików konfiguracyjnych. W systemach, gdzie kolejność oceny reguł ma znaczenie (np. pierwsza pasująca reguła blokuje kolejne), ta poprawka jest kluczowa dla przewidywalnego działania. Użytkownicy mogą teraz korzystać z bardziej złożonych konfiguracji z wieloma warstwami uprawnień, które działają zgodnie z oczekiwaniami.

    Kluczowe zmiany w wersji 1.14.26

    • Stabilność konfiguracji: Naprawiono sposób parsowania konfiguracji, aby kolejność reguł uprawnień była zachowywana, co jest istotne dla zaawansowanych zasad bezpieczeństwa i dostępu.
    • Lepsza integracja z AI: Poprawiono obsługę wyjścia modeli rozumowania (reasoning) DeepSeek przez bramkę OpenRouter, co zwiększa stabilność tej ścieżki dostępu do modeli.
    • Przejrzystość sieciowa: Wszystkie żądania HTTP wysyłane przez OpenCode zawierają teraz nagłówek User-Agent: opencode/<wersja>, co ułatwia identyfikację ruchu w logach serwerów i telemetrii dostawców.
    • Rozszerzone wsparcie edytorów: Interfejs TUI zyskał obsługę edytora Zed, co jest korzystne dla użytkowników tego szybko zyskującego popularność narzędzia.
    • Lepsze wskazówki dla nowych użytkowników: Gdy nie skonfigurowano żadnego modelu, TUI wyświetla teraz podpowiedź o komendzie /connect, co ułatwia rozpoczęcie pracy.
    • Inteligentniejsze wykrywanie blokad: Ulepszono mechanizm wykrywania blokad edytora, aby ignorował blokady z niezwiązanych obszarów roboczych (workspace), co eliminuje fałszywe alarmy przy pracy z wieloma projektami.

    Dla osób korzystających z modeli AI poprzez OpenRouter, poprawka dotycząca DeepSeek jest istotna. Modele z funkcją rozumowania, takie jak DeepSeek-R1, generują szczegółowe, krok po kroku wyjaśnienia swojej pracy. Usterka, którą naprawiono, mogła powodować problemy z poprawnym przetwarzaniem i wyświetlaniem tego typu strukturalnego wyjścia, co mogło zniekształcać odpowiedzi asystenta. Dzięki tej poprawce współpraca z zaawansowanymi modelami przez OpenRouter powinna być teraz bardziej płynna.

    Nowy nagłówek User-Agent to mała, ale ważna zmiana dla administratorów i bardziej zaawansowanych użytkowników. Pozwala on na łatwe odróżnienie ruchu generowanego przez OpenCode od innych narzędzi w logach serwerów lub dashboardach dostawców usług AI, co ułatwia debugowanie, monitorowanie użycia i rozliczanie kosztów.

    W interfejsie użytkownika najciekawszą nowością jest dodanie Zed do listy obsługiwanych edytorów. Zed to wydajny edytor, napisany w Rust, który zdobywa uznanie w społeczności. Jego integracja oznacza, że OpenCode może teraz lepiej współpracować z kontekstem tego edytora, na przykład odczytywać otwarty plik czy śledzić zmiany. Poprawka w wykrywaniu blokad obszarów roboczych rozwiązuje problem, gdy OpenCode błędnie interpretował blokadę z innego, otwartego równolegle projektu jako sygnał, że bieżący plik jest już edytowany.

    Co to oznacza dla użytkowników?

    Wydanie v1.14.26 wpisuje się w cykl stabilizacyjny projektu OpenCode. Nie wprowadza rewolucyjnych nowych funkcji, ale koncentruje się na tym, by podstawowe mechanizmy działały bez zarzutu. Dla zespołów wdrażających OpenCode w szerszej skali stabilność konfiguracji i przejrzystość ruchu sieciowego są nieocenione. Dla pojedynczych deweloperów płynniejsza praca z modelami przez OpenRouter i lepsza integracja z ulubionymi edytorami przekładają się na wygodę codziennego programowania.

    W kontekście szerszej roadmapy projektu ta wersja przygotowuje grunt pod dalsze zmiany. Stabilne parsowanie konfiguracji jest fundamentem dla przyszłych rozszerzeń, a solidna integracja z zewnętrznymi edytorami otwiera drogę do jeszcze lepszej współpracy między terminalowym asystentem a graficznym środowiskiem programisty. OpenCode konsekwentnie udowadnia, że bycie asystentem "terminal-first" nie wyklucza doskonałej współpracy z resztą ekosystemu deweloperskiego.


    Źródła

  • Codex Release 0.125.0: ulepszenia dla pracy zdalnej i lepsze zarządzanie pluginami

    Codex Release 0.125.0: ulepszenia dla pracy zdalnej i lepsze zarządzanie pluginami

    OpenAI Codex, istotny element systemów AI wspierających programistów, otrzymał nową wersję 0.125.0, która poprawia integrację z serwerami aplikacji oraz zarządzanie pluginami. Ta aktualizacja koncentruje się na ułatwieniu długotrwałych sesji, pracy zdalnej i integracji z innymi aplikacjami, co czyni Codex bardziej funkcjonalnym w środowiskach hostingowych i DevOps. Kluczowe zmiany obejmują dodanie transportu przez Unix socket, ulepszone zarządzanie pluginami zdalnymi oraz poprawę stabilności na systemie Windows.

    Najważniejsze fakty dotyczące wydania 0.125.0

    • Unix socket transport został dodany, co oferuje alternatywną i często bardziej wydajną metodę komunikacji dla serwerów aplikacji.
    • Zarządzanie pluginami zostało rozszerzone, co umożliwia instalację pluginów z zdalnych źródeł oraz aktualizację skonfigurowanych marketplace'ów.
    • Persystencja profilów uprawnień została wzmocniona, co zapewnia, że konfiguracja uprawnień użytkownika utrzymuje się między sesjami TUI.
    • Integracja z AWS/Bedrock została poprawiona, co umożliwia bardziej efektywne odkrywanie modeli AI w środowiskach chmurowych.
    • Naprawy stabilności obejmują lepszą stabilność sandboxa na Windows, poprawę niezawodności połączeń WebSocket oraz bardziej precyzyjne raportowanie tokenów reasoning dla programowych konsumentów.

    Unix socket i ulepszenia serwera aplikacji

    Dodanie transportu przez Unix socket to istotna zmiana dla deweloperów pracujących w środowiskach zdalnych lub integrujących Codex z innymi usługami. Socket Unix, jako mechanizm komunikacji między procesami, często zapewnia mniejsze opóźnienia i wyższą wydajność niż tradycyjne połączenia sieciowe. Dzięki temu Codex może działać bardziej jak interaktywna warstwa serwisowa, co jest ważne dla programowania opartego na interakcji z AI.

    Dodatkowo, aktualizacja wprowadza poprawki w paginacji dla operacji resume i fork, implementuje sticky environments oraz dodaje wsparcie dla konfiguracji i przechowywania wątków zdalnych. Wszystkie te elementy mają na celu ułatwienie długotrwałych sesji pracy z AI, nawet gdy deweloper odłącza się i ponownie łączy z systemem.

    Ulepszenia w zarządzaniu pluginami zdalnymi

    Drugim ważnym aspektem tego wydania jest modernizacja systemu zarządzania pluginami w serwerze aplikacji. Możliwość instalacji pluginów bezpośrednio z zdalnych źródeł otwiera nowe możliwości dla rozszerzania funkcjonalności Codex. Deweloperzy mogą teraz łatwo dodawać nowe narzędzia i integracje bez konieczności ręcznego kopiowania plików czy skomplikowanych procedur konfiguracyjnych.

    Ponadto, mechanizm aktualizacji skonfigurowanych marketplace'ów zapewnia, że dostępny ekosystem pluginów pozostaje aktualny i bezpieczny. To szczególnie istotne w kontekście bezpieczeństwa, gdzie starsze wersje pluginów mogą zawierać luki. Dla zespołów korzystających z Codex w środowiskach produkcyjnych, ta automatyzacja zmniejsza koszty operacyjne i ryzyko.

    Lepsza współpraca z AWS Bedrock i naprawy stabilności

    Lepsza współpraca z AWS Bedrock i naprawy stabilności

    Integracja z AWS Bedrock, platformą dla modeli fundacyjnych Amazona, została udoskonalona w zakresie odkrywania. Codex może teraz efektywniej odnajdywać i korzystać z modeli hostowanych w Bedrock, co jest istotne dla firm zintegrowanych z ekosystemem AWS. To krok w kierunku większej interoperacyjności między różnymi platformami AI.

    W zakresie napraw, wersja 0.125.0 rozwiązuje kilka problemów. Stabilność sandboxa na Windows została poprawiona, co jest korzystne dla deweloperów korzystających z tego systemu. Lepsza niezawodność połączeń WebSocket zmniejsza ryzyko utraty komunikacji podczas długich sesji. Ulepszenie w raportowaniu tokenów reasoning pozwala na dokładniejsze monitorowanie wykorzystania i kosztów.

    Znaczenie dla web dev i środowisk DevOps

    To wydanie ma szczególne znaczenie dla osób pracujących w web development, DevOps oraz przy projektach wykorzystujących sztuczną inteligencję do automatyzacji. Ulepszenia w pracy zdalnej sprawiają, że Codex staje się bardziej atrakcyjnym narzędziem dla zespołów rozproszonych lub pracujących w modelu hostingowym. Styl programowania oparty na interakcji z AI zyskuje na stabilności i elastyczności.

    Możliwość lepszej integracji z serwerami aplikacji oznacza, że Codex może być bardziej efektywnym elementem w pipeline'ach CI/CD oraz w środowiskach mikroserwisowych. Ulepszone zarządzanie pluginami otwiera drogę do tworzenia specjalizowanych ekosystemów rozszerzeń, które dostosowują Codex do specyficznych potrzeb projektów.

    Wnioski

    Wydanie 0.125.0 OpenAI Codex nie jest rewolucyjne, ale stanowi praktyczny krok w ewolucji tego narzędzia. Skupienie na integracji, stabilności i zarządzaniu pluginami odpowiada na rzeczywiste potrzeby deweloperów korzystających z AI w bardziej złożonych środowiskach produkcyjnych. Unix socket, lepsze zarządzanie zdalnymi pluginami i poprawki dla Windows – wszystkie te elementy mają na celu ułatwienie codziennego użytkowania.

    W kontekście szybkiego rozwoju narzędzi AI dla programistów, takie udoskonalenia infrastrukturalne są kluczowe dla szerszej adopcji. Codex, z tym wydaniem, pokazuje, że rozwija swoje możliwości generowania kodu i inwestuje w fundamenty, które pozwalają mu działać jako niezawodna, integrowalna usługa.


    Źródła

  • Aktualizacja Factory CLI: przełącznik trybu szybkiego, lepsza walidacja i poprawy wydajności na Windows

    Aktualizacja Factory CLI: przełącznik trybu szybkiego, lepsza walidacja i poprawy wydajności na Windows

    Factory, platforma AI dla programistów, wydała nową wersję swojego narzędzia wiersza poleceń (CLI), znanego jako Factory CLI. Aktualizacja skupia się na poprawie wydajności i stabilności, co wspiera programistów w budowaniu, debugowaniu i refaktoryzacji kodu.

    Nowa wersja wprowadza konkretne funkcjonalności oraz poprawki stabilnościowe i usprawnienia w zarządzaniu sesjami, które są istotne dla interaktywnych przepływów pracy oferowanych przez Factory. Ulepszenia te przekładają się na bardziej płynne doświadczenie podczas pracy nad projektami webowymi i zadaniami z zakresu DevOps.

    Kluczowe zmiany w najnowszej wersji

    • Usprawnienia trybów modeli – Factory CLI oferuje tryb interaktywny i nieinteraktywny oraz przełączniki automatyzacji, co wspiera elastyczną pracę z modelami AI.
    • Walidacja artefaktów – Narzędzie wspiera procesy walidacji dla generowanych wyników, co zwiększa ich niezawodność i spójność.
    • Wydajność i stabilność na Windows – Prace nad optymalizacją czasu startu i zarządzaniem procesami mają na celu poprawę doświadczenia na platformie Windows.
    • Czystsze logi CLI – Interfejs wiersza poleceń generuje teraz bardziej czytelne logi, co ułatwia diagnostykę.
    • Usprawnienia sesji i integracji – Wprowadzono poprawki stabilnościowe dla klienta IDE oraz lepsze zarządzanie integracjami i mechanizmami obsługi sesji.

    Elastyczne tryby pracy i przełączanie modeli

    Factory CLI zapewnia użytkownikom elastyczność w pracy z modelami AI poprzez różne tryby pracy. Umożliwia to dostosowanie interakcji do potrzeb zadania, zarówno w trybie interaktywnym, jak i w zautomatyzowanym przepływie. Sprawne przełączanie się między różnymi konfiguracjami i modelami jest kluczowe dla utrzymania produktywności w dynamicznych środowiskach deweloperskich.

    Dla programistów pracujących w trybie „vibe coding” lub potrzebujących szybkich iteracji, elastyczne zarządzanie sesjami i modelami może znacząco wpłynąć na produktywność.

    Walidacja artefaktów i czystsze logi

    Wsparcie dla procesu walidacji artefaktów, czyli strukturyzowanych wyników generowanych przez AI, jest istotnym elementem narzędzia. Dbałość o spójność i integralność tych danych jest kluczowa dla niezawodności w zautomatyzowanych pipeline'ach.

    Dodatkowo, poprawki dotyczące czystszych logów CLI ułatwiają śledzenie przebiegu misji i rozwiązywanie problemów, co jest szczególnie cenne w złożonych środowiskach deweloperskich i DevOps.

    Windows w centrum uwagi: wydajność i niezawodność

    Dla użytkowników pracujących na Windows trwają prace nad optymalizacją doświadczenia. Celem jest skrócenie czasu uruchamiania oraz zwiększenie stabilności zarządzania procesami działającymi w tle.

    Te zmiany, w połączeniu z wcześniejszymi poprawkami, pokazują, że Factory dąży do zapewnienia wysokiej jakości doświadczenia na tej platformie. Szybszy startup i mniej awarii procesów w tle to korzyści dla każdego, kto używa Factory CLI na Windows.

    Dopracowanie fundamentów: sesje, integracje i IDE

    Oprócz głównych funkcji, najnowsze aktualizacje zawierają wiele poprawek „pod maską”. Usprawniono zarządzanie integracjami, aby uniknąć duplikowania komunikatów między różnymi powierzchniami produktu. Mechanizmy obsługi sesji, które są kluczowe dla interaktywnego trybu pracy Factory CLI, zostały dopracowane, co umożliwia operacje takie jak resume czy fork.

    Stabilność klienta IDE została również wzmocniona poprzez szereg poprawek błędów. Te elementy składają się na bardziej płynne i przewidywalne środowisko pracy, w którym deweloper może skupić się na zadaniu, a nie na walce z narzędziem.

    Podsumowanie

    Aktualizacja Factory CLI to ewolucja, która łączy nowe, użyteczne funkcje z poprawkami stabilności i wydajności. Dla społeczności Factory jest to oznaka kontynuacji rozwoju w kierunku bardziej niezawodnego i przyjaznego dla programisty narzędzia, które ma potencjał stać się nieodłącznym partnerem w codziennej pracy z kodem.


    Źródła