Kategoria: Technologie

  • Claude Code Wprowadza Interaktywne Lekcje i Optymalizuje Wydajność w Wersji 2.1.90

    Claude Code Wprowadza Interaktywne Lekcje i Optymalizuje Wydajność w Wersji 2.1.90

    Nowa aktualizacja Claude Code, oznaczona numerem 2.1.90, przynosi znaczące usprawnienia zarówno dla nowych użytkowników, jak i zaawansowanych deweloperów. Wydanie skupia się na stabilności, naprawia uciążliwe błędy i wzmacnia bezpieczeństwo, szczególnie w środowiskach DevOps, a także wprowadza kluczowe funkcjonalności, takie jak asynchroniczne agenty i pamięć sesji.

    Nowe możliwości: asynchroniczne agenty i pamięć sesji

    Flagową funkcją tej aktualizacji jest wprowadzenie zaawansowanych, asynchronicznych agentów. Pozwalają one na bardziej złożoną i długotrwałą automatyzację zadań programistycznych, działając w tle i zarządzając wieloma wątkami pracy. To ogromny krok naprzód w kwestii efektywności, zwłaszcza w kontekście „vibe coding” – płynnego, intuicyjnego programowania wspomaganego przez AI.

    Dodano również ulepszoną pamięć sesji, która pozwala Claude Code lepiej śledzić kontekst i stan długich, złożonych zadań. Dzięki temu narzędzie może płynniej współpracować z programistą przez cały cykl rozwoju funkcji – od planowania po wdrożenie – zachowując spójność i unikając powtarzania instrukcji.

    Znaczące usprawnienia wydajności i stabilności

    Pod maską wersji 2.1.90 kryje się solidna porcja optymalizacji. Inżynierowie skupili się na poprawie działania długotrwałych sesji, które są kluczowe dla zaawansowanych agentów AI i złożonych workflow hostingowych.

    Przeprojektowano architekturę, aby lepiej obsługiwać warstwowy system uprawnień, integracje MCP (Model Context Protocol) i podagenty. Te zmiany zwiększają ogólną niezawodność systemu, szczególnie podczas wykonywania rozbudowanych, zautomatyzowanych zadań.

    Krytyczne poprawki błędów dla płynnej automatyzacji

    Aktualizacja usuwa kilka uciążliwych problemów, które mogły zakłócać pracę, szczególnie w zautomatyzowanych pipeline'ach. Rozwiązano konflikty edycji plików, w tym irytujący błąd „File content has changed”, który często pojawiał się przy hookach typu format-on-save, oraz wyeliminowano fałszywe pozytywy przy kolejnych edycjach. Działanie narzędzia zostało zoptymalizowane, aby zapewnić płynniejszą i bardziej przewidywalną automatyzację.

    Wzmacnianie bezpieczeństwa i kontroli środowiskowej

    W kwestii bezpieczeństwa wersja 2.1.90 wprowadza wzmocnienia sandboxa, niezbędne w środowiskach produkcyjnych DevOps. Architektura z warstwowym systemem uprawnień i hookami zapewnia lepszą kontrolę nad wykonywanymi działaniami.

    Dodano także nowe zmienne środowiskowe, które dają administratorom większą swobodę w konfiguracji środowisk offline lub wyspecjalizowanych. Ulepszono tryb Auto, który teraz ściślej przestrzega jawnych instrukcji, takich jak „don't push”, oraz wprowadzono inteligentniejsze bramki workflow.

    Podsumowanie: krok naprzód dla profesjonalnych inżynierów

    Wydanie Claude Code 2.1.90 to dowód na skupienie się na potrzebach profesjonalnych inżynierów oprogramowania. Łączy ono zaawansowane możliwości automatyzacji (asynchroniczne agenty i pamięć sesji) z głębokimi usprawnieniami technicznymi, które wspierają wymagające, zautomatyzowane workflow.

    Te zmiany, będące częścią szybkiego cyklu iteracyjnego projektu, bezpośrednio wspierają nowoczesne praktyki web developmentu i AI. Dzięki nim długotrwałe sesje agentów są stabilniejsze, automatyzacja mniej podatna na błędy, a możliwości narzędzia – znacznie szersze. To kompleksowa aktualizacja, która podnosi poprzeczkę w kategorii inteligentnych asystentów programistycznych.


    Źródła

  • Codex 0.118.0: Wzmocnione Zabezpieczenia Sieciowe, Nowy Flow Logowania i Poprawki Interfejsu

    Codex 0.118.0: Wzmocnione Zabezpieczenia Sieciowe, Nowy Flow Logowania i Poprawki Interfejsu

    OpenAI wydało kolejną aktualizację swojego narzędzia CLI dla deweloperów. Codex 0.118.0 przynosi ulepszenia w obszarach bezpieczeństwa, autoryzacji i interfejsu użytkownika, skupiając się na stabilizacji i usprawnieniu codziennych workflowów programistów. Ta wersja jest dostępna na platformie Chocolatey i kontynuuje trend wzmacniania sandboxów oraz integracji z zewnętrznymi dostawcami modeli AI.

    Aktualizacja skupia się na naprawie błędów i dostarczeniu funkcji, które bezpośrednio przekładają się na komfort pracy. To nie są rewolucyjne zmiany, lecz konkretne usprawnienia, które eliminują irytujące problemy i otwierają nowe możliwości, szczególnie dla zespołów korzystających z własnej infrastruktury AI.

    Główne ulepszenia w sieci i sandboxach

    Kluczową zmianą w tej wersji są prace nad poprawą niezawodności sandboxów. Zmiany te wpisują się w szerszą strategię Codexa: oferowanie potężnych, a zarazem bezpiecznych środowisk izolowanych, które pozwalają AI na wykonywanie poleceń systemowych, instalację zależności czy operacje na plikach bez ryzyka dla głównego systemu.

    Nowe możliwości autoryzacji i logowania

    Codex 0.118.0 wprowadza ulepszenia w sposobie uwierzytelniania. To ważne ułatwienie dla firm, które integrują Codexa z własnymi lub zewnętrznymi modelami językowymi, gdzie konieczne jest sprawne zarządzanie kluczami API.

    Praktyczne usprawnienia CLI i interfejsu TUI

    W codziennej pracy w terminalu ta wersja wprowadza istotne poprawki. Interfejs tekstowy użytkownika (TUI) również otrzymał zestaw poprawek. Usunięto także przestarzałe elementy, oczyszczając kod i interfejs.

    Dlaczego to ważne dla deweloperów webowych i DevOps?

    Codex ewoluuje w kierunku kompleksowego narzędzia do vibe codingu i rozwoju oprogramowania wspomaganego przez AI. Możliwość bezpiecznego uruchamiania poleceń shell, operacji git czy instalacji zależności w sandboxie, sterowana językiem naturalnym, idealnie wpisuje się w workflow nowoczesnego dewelopera. Dla zespołów DevOps łatwa integracja z niestandardowymi modelami to klucz do włączenia wewnętrznych narzędzi AI do procesu.

    Aktualizacja 0.118.0 ma przede wszystkim charakter stabilizacyjny. To solidny krok, który przygotowuje grunt pod przyszłe, bardziej eksperymentalne funkcje.

    Podsumowanie i wnioski

    Codex 0.118.0 może nie jest najbardziej spektakularną aktualizacją, ale z pewnością należy do tych najbardziej praktycznych. Koncentruje się na tym, co istotne w zastosowaniach produkcyjnych: bezpieczeństwie sieci, niezawodnym logowaniu, wygodzie pracy w terminalu i stabilności. Naprawa bugów w TUI to zmiana, która realnie przyspiesza codzienną pracę.

    Ogólny kierunek jest jasny: Codex staje się coraz dojrzalszym, bardziej konfigurowalnym i bezpiecznym środowiskiem do programowania wspomaganego sztuczną inteligencją. Każdemu, kto już korzysta z tego narzędzia, zaleca się aktualizację do wersji 0.118.0, choć – jak zawsze – warto najpierw przetestować ją w środowisku testowym.


    Źródła

  • Claude Code Wchodzi na Nowy Poziom: Wydanie 2.1.89 z Ulepszeniami Bezpieczeństwa, Przyjacielem i Ogromem Poprawek

    Claude Code Wchodzi na Nowy Poziom: Wydanie 2.1.89 z Ulepszeniami Bezpieczeństwa, Przyjacielem i Ogromem Poprawek

    Anthropic wypuściło właśnie nową wersję swojego narzędzia dla programistów – Claude Code. To nie jest zwykła aktualizacja z drobnymi poprawkami. Wydanie 2.1.89, które trafiło do użytkowników 31 marca 2026 roku, przynosi istotne ulepszenia w zarządzaniu sesjami, kluczowe poprawki stabilności oraz… zabawnego „towarzysza”. To solidna aktualizacja, która pokazuje, jak dojrzała staje się ta platforma.

    Kluczowe ulepszenia w kontroli dostępu i sesjach

    Jednym z filarów tej aktualizacji jest znacznie lepsza kontrola nad tym, co Claude Code 2.1.89 może robić. Wprowadzono nową opcję uprawnień „defer” dla hooków PreToolUse. W praktyce oznacza to, że sesje bez interfejsu użytkownika (headless) mogą teraz wstrzymać działanie w momencie wywołania narzędzia, a następnie wznowić pracę z określonymi flagami. Daje to administratorom i twórcom zautomatyzowanych workflow znacznie większą precyzję.

    Poza tym reguły zezwoleń (allow rules) zostały udoskonalone tak, aby mogły sprawdzać cel docelowy rozwiązanego dowiązania symbolicznego (symlink), a nie tylko żądaną ścieżkę. To ważne wzmocnienie zabezpieczeń, które utrudnia obejście kontroli dostępu poprzez manipulację dowiązaniami.

    Stabilność i wydajność: koniec z wyciekami pamięci i crashami

    Dla użytkowników pracujących nad długimi, złożonymi projektami wersja 2.1.89 to prawdziwy zastrzyk stabilności. Zespół naprawił kilka krytycznych problemów, które potrafiły uprzykrzyć życie.

    Wyeliminowano wyciek pamięci, w którym duże wejścia JSON były przetrzymywane w pamięci jako klucze cache LRU w długo działających sesjach. Mogło to stopniowo prowadzić do spadku wydajności. Dodatkowo rozwiązano problem crashowania aplikacji podczas usuwania wiadomości z bardzo dużych plików sesji przekraczających 50 MB. Jest to szczególnie ważne dla zespołów, które korzystają z Claude Code 2.1.89 przez wiele dni bez restartu.

    Usprawniono też działanie serwera LSP (Language Server Protocol). Wcześniej po awarii wpadał on w stan „zombie” i odmawiał współpracy aż do restartu całej sesji. Teraz po prostu uruchamia się ponownie przy kolejnym żądaniu.

    Poprawki dla systemów Windows i macOS

    Wydanie 2.1.89 przynosi też wiele poprawek specyficznych dla poszczególnych systemów operacyjnych, co świadczy o dbałości o doświadczenia wszystkich użytkowników.

    W systemie Windows naprawiono irytujący błąd, w którym narzędzia Edit/Write podwajały znaki CRLF, jednocześnie usuwając twarde podziały wierszy w Markdown (dwie spacje na końcu linii). Dodatkowo rozwiązano problem z trybem głosowym, który na Windowsie kończył się błędem z komunikatem „WebSocket upgrade rejected with HTTP 101”.

    Użytkownicy macOS docenią z kolei naprawę deep linków, które wcześniej czasami nie chciały się otwierać.

    Nowa funkcja: „Buddy” i ulepszenia dla deweloperów

    Nie samą pracą człowiek żyje. Wydanie 2.1.89 zawiera też żartobliwą funkcję „buddy” – małego towarzysza w terminalu. To miły, lekki akcent w narzędziu, które zwykle kojarzy się z intensywnym kodowaniem.

    Poza tym wprowadzono mnóstwo usprawnień w codziennej pracy dewelopera. Ulepszono ostrzeżenia w narzędziu Bash, które teraz informują, gdy polecenie formatera lub lintera modyfikuje pliki, które zostały już wcześniej odczytane. Pomaga to uniknąć błędów typu „stale-edit”. Poprawiono też komunikaty o niedostępności narzędzi – teraz wyjaśniają one, dlaczego dane narzędzie jest niedostępne i co zrobić, aby je uruchomić.

    Wprowadzono również wsparcie dla podpisów manifestów w wydaniach, co zwiększa bezpieczeństwo procesu aktualizacji. Użytkownicy mogą teraz skonfigurować kanał aktualizacji: "latest" dla natychmiastowego dostępu do nowości lub "stable" dla wersji przetestowanej przez tydzień, co pozwala uniknąć wydań z poważnymi regresjami.

    Podsumowanie: dojrzałość i precyzja

    To wydanie Claude Code 2.1.89 jest przykładem świetnie zbalansowanej aktualizacji. Nie wprowadza rewolucyjnych zmian w interfejsie, ale za to skupia się na fundamentach: bezpieczeństwie, stabilności i wydajności. Poprawki dotyczące wycieków pamięci, crashy przy dużych plikach, lepsza kontrola uprawnień i dziesiątki mniejszych usprawnień sprawiają, że na narzędziu można po prostu bardziej polegać.

    Dodatkowo wprowadzenie konfigurowalnych kanałów aktualizacji i podpisów manifestów pokazuje dbałość o zaawansowanych użytkowników i administratorów. A lekki, żartobliwy akcent w postaci „buddy’ego” przypomina, że narzędzia dla programistów, nawet tak zaawansowane, mogą mieć odrobinę ludzkiej twarzy. To solidny krok naprzód dla całej platformy.


    Źródła

  • Codex Wdraża Nową Strategię Bezpieczeństwa: Wersja 0.119.0-Alpha.1 Chroni Pliki i Rozbudowuje Workflow

    Codex Wdraża Nową Strategię Bezpieczeństwa: Wersja 0.119.0-Alpha.1 Chroni Pliki i Rozbudowuje Workflow

    Najnowsza wersja alfa Codex, oznaczona jako 0.119.0-Alpha.1, nie wprowadza rewolucyjnych funkcji, ale konsekwentnie buduje fundamenty bezpieczeństwa i stabilności. To właśnie takie wydania często mają największy wpływ na codzienną pracę deweloperów, eliminując subtelne, lecz dokuczliwe problemy oraz wzmacniając ochronę projektu.

    Zaostrzenie polityki sandboxa i sieci

    Kluczowym obszarem poprawy w tej wersji alfa jest sandbox – izolowane środowisko, w którym Codex wykonuje operacje. Wprowadzone zmiany obejmują szereg uściśleń dotyczących sieci oraz obsługi przypadków brzegowych na różnych platformach. Na przykład polityka proxy sieciowego jest teraz odświeżana automatycznie po zmianach w sandboxie, co zapewnia ciągłość bezpiecznych połączeń.

    Co ważne dla użytkowników Windows, poprawiono obsługę adresów w firewallu, co jest kluczowe dla reguł egress (ruch wychodzący) działających wyłącznie przez proxy. Bezpośrednio wpływa to na bezpieczny rozwój aplikacji wymagających kontrolowanej komunikacji sieciowej.

    Naprawiono też błąd krytyczny (panic) klienta HTTP w sandboxie na macOS oraz wyciszono nieistotne ostrzeżenia bubblewrap, co przekłada się na stabilniejszą pracę. Drobna, lecz znacząca poprawka dotyczy też błędów apply_patch w trybie read-only – teraz są one prezentowane w sposób bardziej czytelny.

    Bezpieczeństwo plików projektowych od pierwszej linii

    Jedna z najistotniejszych zmian w zakresie bezpieczeństwa dotyczy ochrony plików .codex w lokalnym projekcie. Dotychczas istniała luka: pierwsze utworzenie takich plików mogło ominąć mechanizm wymagający zatwierdzenia przez użytkownika (approval checks). W tej wersji alfa ta luka została zamknięta. Oznacza to, że nawet inicjalne zapisy do tych kluczowych plików konfiguracyjnych są teraz chronione, co stanowi kolejną barierę przed przypadkowym lub celowym nadpisaniem krytycznych danych projektu.

    Poprawki dotyczą także bardziej zaawansowanych scenariuszy. Naprawiono obsługę uprawnień sandboxa dla symlinkowanych writable roots i carveouts. Bez tej poprawki pewne operacje w powłoce (shell) czy workflow apply_patch mogły kończyć się niepowodzeniem, utrudniając pracę.

    Stabilność TUI, MCP i połączeń sieciowych

    Wydanie przynosi także szereg poprawek zwiększających ogólną stabilność i niezawodność środowiska pracy. Wyeliminowano błędy typu panic przy komendzie codex --remote wss://... poprzez poprawne instalowanie providera kryptograficznego Rustls przed nawiązywaniem połączeń TLS przez WebSocket. Rozwiązuje to problem, który mógł uniemożliwiać korzystanie z funkcji remote.

    W obszarze Model Context Protocol (MCP), dzięki aktualizacji do rmcp 0.8.3, zwiększono niezawodność uruchamiania serwerów MCP. Guardian – system odpowiedzialny za analizę i zatwierdzanie działań – stał się bardziej efektywny dzięki wysyłaniu delt (różnic) w transcriptach zamiast pełnej historii za każdym razem. Dodano też stabilne ID dla recenzji w Guardianie, co ułatwia śledzenie procesów.

    W Tool UI (TUI) zachowano oryginalną kolejność wyników wyszukiwania narzędzi, co jest istotne dla ergonomii pracy – algorytmiczne zmienianie kolejności wyników często dezorientuje użytkowników. Usprawniono też rejestrowanie (recording) dla rolloutów poprzez implementację mechanizmu retry dla nieudanych operacji flush, zmniejszając ryzyko utraty danych diagnostycznych.

    Rozbudowa workflow: autentykacja i komenda exec

    Choć główny nacisk w tym wydaniu położono na bezpieczeństwo i stabilność, nie zabrakło praktycznych usprawnień w workflow. Dodano nowy proces autentykacji dla ChatGPT poprzez device code. To alternatywna, często bezpieczniejsza lub wygodniejsza metoda logowania, szczególnie w środowiskach z ograniczonym dostępem.

    Rozbudowano także możliwości komendy codex exec, która teraz obsługuje piped input. To prosta, lecz bardzo użyteczna zmiana, która pozwala płynniej integrować Codex z istniejącymi potokami (pipelines) deweloperskimi, umożliwiając przekazywanie danych bezpośrednio z innych procesów.

    Podsumowanie: Fundamenty dla Vibe Coding

    Wersja 0.119.0-Alpha.1 Codex to przykład systematycznej pracy nad podstawami. Nie znajdziemy tu spektakularnych nowych modeli AI czy przełomowych interfejsów, ale otrzymujemy solidne wzmocnienie sandboxa, uszczelnienie ochrony lokalnych plików projektu oraz szereg poprawek zwiększających stabilność TUI, MCP i połączeń sieciowych.

    Dla deweloperów pracujących w trybie vibe coding, gdzie płynność i bezpieczeństwo są kluczowe, takie wydania są bezcenne. Eliminują mikroproblemy zakłócające flow i budują środowisko, w którym można skupić się na tworzeniu bez obaw o przypadkowe naruszenie bezpieczeństwa projektu czy nieoczekiwane awarie. To krok w stronę rozwoju Codex nie tylko jako potężnego narzędzia AI, ale także stabilnej i bezpiecznej platformy programistycznej.


    Źródła

  • Google Gemma 4: Nowa Era Otwartych Modeli AI z Ogromną Mocą

    Google Gemma 4: Nowa Era Otwartych Modeli AI z Ogromną Mocą

    Google właśnie pokazał światu nową generację swoich flagowych, otwartych modeli AI. Gemma 4 to nie zwykła iteracja, lecz zasadniczy skok, który stawia te lekkie konstrukcje w ścisłej czołówce globalnych rankingów, pozwalając im konkurować z modelami wielokrotnie większymi. To wydanie kładzie duży nacisk na zaawansowane rozumowanie i tzw. zdolności agentowe (agentic workflows), czyli umiejętność samodzielnego planowania i wykonywania wieloetapowych zadań przez AI.

    Wydajność nowej rodziny modeli jest imponująca. Wersja 26B typu Mixture of Experts (MoE) plasuje się na 6. miejscu na światowej liście liderów LMSYS Chatbot Arena wśród modeli otwartych. Co najważniejsze, Gemma 4 potrafi wygrywać w benchmarkach z modelami aż 20 razy większymi, co ma kluczowe znaczenie dla praktycznych wdrożeń.

    Rodzina modeli i ich kluczowe możliwości

    Google oferuje Gemmę 4 w czterech precyzyjnie dopasowanych rozmiarach. Są to: Effective 2B (E2B) dla maksymalnej oszczędności pamięci, Effective 4B (E4B) jako kompromis między możliwościami a zasobami na urządzeniach brzegowych (edge devices), oraz 26B MoE (A4B), charakteryzujący się niesamowitą szybkością dzięki aktywacji tylko około 4 miliardów parametrów jednocześnie. Modele E2B i E4B mają odpowiednio około 2,3 mld i 4,5 mld aktywnych parametrów.

    Prawdziwa siła Gemmy 4 leży w jej uniwersalności. Wszystkie modele są natywnie multimodalne – przetwarzają zarówno tekst, jak i obrazy o zmiennym formacie. Każdy z nich radzi sobie także z wideo, a architektura wspiera również dźwięk, co otwiera drogę do zaawansowanej analizy multimodalnej.

    Kluczową nowością jest nacisk na rozumowanie i działania agentowe. Gemma 4 została zaprojektowana od podstaw jako świetny „myśliciel”, potrafiący prowadzić wieloetapowe rozumowanie i planowanie. To właśnie ta cecha, zwykle zarezerwowana dla największych, zamkniętych modeli, jest tu dostępna w lekkiej formie. Dodano też natywne wsparcie dla promptów systemowych (system prompts), co pozwala na bardziej kontrolowane i ustrukturyzowane interakcje z AI.

    Przełom w wydajności i dostępności

    Gemma 4 dokonuje prawdziwej rewolucji w zakresie wydajności na urządzeniach brzegowych. Dzięki ulepszeniom architektonicznym, takim jak Grouped Query Attention (GQA) czy przycięte osadzenia pozycyjne Rotary (p-RoPE), modele działają niezwykle sprawnie. Testy wykazują, że osiągają one wysoką wydajność nawet na ograniczonym sprzęcie. Z kolei przy wykorzystaniu akceleracji dedykowanych jednostek NPU szybkość generowania tekstu wzrasta do tysięcy tokenów na sekundę.

    Rozszerzone okna kontekstowe (context window) – do 128K dla małych modeli i 256K dla średnich – pozwalają na dynamiczną pracę z długimi dokumentami. Inżynierowie odnotowali znaczące przyspieszenie fazy przetwarzania wstępnego (prefills) w modelu E2B. Wszystko to przekłada się na realne korzyści: osiąganie poziomu modeli klasy „frontier” przy ułamku kosztów sprzętowych, możliwość pracy offline, lepszą prywatność i mniejsze opóźnienia.

    Dla programistów Gemma 4 przynosi znaczący postęp w generowaniu kodu i obsłudze wywołań funkcji (function calling), umożliwiając lokalną asystę programistyczną wysokiej jakości. Model wspiera od razu ponad 35 języków, będąc trenowanym na korpusie obejmującym ponad 140 języków, co czyni go narzędziem globalnym.

    Co to oznacza dla rynku AI?

    Wydanie Gemmy 4 na liberalnej licencji Apache 2.0 to jasny sygnał dotyczący strategii Google. Od debiutu pierwszej wersji, modele te cieszą się ogromną popularnością w społeczności, która stworzyła dziesiątki tysięcy ich wariantów. Teraz Google nie tylko dostarcza otwarte alternatywy, ale sprawia, że są one w pełni konkurencyjne pod względem możliwości.

    To posunięcie przyspiesza demokratyzację zaawansowanej sztucznej inteligencji. Firmy i deweloperzy, którzy potrzebowali mocy największych modeli, ale obawiali się kosztów, uzależnienia od chmury (vendor lock-in) lub wymogów prywatności, otrzymują potężne narzędzie do wdrożeń lokalnych i brzegowych. Gemma 4 jest już dostępna wieloma kanałami, w tym przez Hugging Face, Google AI Edge, a także w systemie Android w ramach wersji zapoznawczej AICore dla deweloperów.

    Podsumowanie

    Gemma 4 to coś więcej niż aktualizacja. To dowód na to, że era zaawansowanej sztucznej inteligencji nie musi być zarezerwowana wyłącznie dla gigantycznych, zamkniętych modeli chmurowych. Google, łącząc najnowocześniejsze techniki architektoniczne z filozofią otwartości, stworzył rodzinę modeli, które są jednocześnie potężne, wszechstronne i niezwykle efektywne. Może to zmienić reguły gry, przyspieszając innowacje i pozwalając na budowę inteligentnych aplikacji bezpośrednio na naszych urządzeniach.

  • Google Gemma 4 oficjalnie: cztery nowe modele, rekordowa wydajność i wolna licencja

    Google Gemma 4 oficjalnie: cztery nowe modele, rekordowa wydajność i wolna licencja

    Google właśnie zaktualizował swoją rodzinę lekkich modeli językowych, wypuszczając Gemmę 4. To nie pojedynczy model, a cała gama czterech architektur dopasowanych do różnych zastosowań – od smartfonów po serwery deweloperskie. Najważniejsze zmiany? Ogromne okna kontekstowe, multimodalność i, po raz pierwszy w historii Gemmy 4, w pełni otwarta licencja Apache 2.0.

    Szczegóły techniczne i architektura

    Rodzina Gemma 4 to cztery odrębne modele, każdy o unikalnym przeznaczeniu. Dwa z nich, E2B (efektywnie 2,3 mld parametrów) i E4B (efektywnie 4,5 mld z embeddings), są zoptymalizowane pod kątem działania na urządzeniach brzegowych (edge). Oferują okno kontekstowe do 128 tysięcy tokenów i obsługują tekst, obrazy oraz audio – to ostatnie natywnie dzięki dedykowanemu enkoderowi. Oznacza to, że mogą działać offline, nawet na Raspberry Pi 5 czy smartfonie, zużywając przy 4-bitowej kwantyzacji mniej niż 1,5 GB pamięci RAM.

    Do bardziej wymagających zadań Google przygotował dwa większe modele. 26B A4B to architektura typu Mixture-of-Experts (MoE), znakomicie sprawdzająca się w zadaniach wymagających rozbudowanego rozumowania i workflowów agentowych. Najpotężniejszym modelem jest w pełni gęsty (dense) 31B. Oba dysponują imponującym oknem kontekstu wynoszącym 256K i przetwarzają tekst, obrazy oraz wideo. Wszystkie modele płynnie operują w ponad 140 językach i obsługują natywne system prompty oraz function calling.

    Wydajność, która zadziwia w benchmarkach

    Tutaj Gemma 4 robi prawdziwe wrażenie. W publicznym rankingu Arena AI Leaderboard, który ocenia jakość odpowiedzi w konwersacji, model 31B zajął 3. miejsce, a 26B – 6. miejsce wśród wszystkich otwartych modeli na świecie (stan na 1 kwietnia 2026). Co najbardziej znaczące, model 31B potrafi prześcignąć w tych testach modele aż 20 razy większe od siebie. To potwierdzony wynik benchmarku, który pokazuje ogromną efektywność nowej architektury.

    Wydajność na urządzeniach brzegowych również jest imponująca. E4B na Raspberry Pi 5, korzystając wyłącznie z CPU, osiąga niską latencję podczas dekodowania. Na dedykowanych akceleratorach NPU, we współpracy z partnerami takimi jak Qualcomm, prędkość generowania znacząco wzrasta. Dzięki technologii LiteRT-LM przetworzenie 4000 tokenów w złożonym, dwuetapowym zadaniu może zająć mniej niż 3 sekundy.

    Przełomowe licencjonowanie Apache 2.0

    Przełomowe licencjonowanie Apache 2.0

    Być może najważniejszą wiadomością dla społeczności deweloperskiej i firm jest zmiana licencji. Gemma 4 to pierwsza iteracja tej rodziny wydana na w pełni otwartej i permisywnej licencji Apache 2.0. W praktyce oznacza to brak jakichkolwiek restrykcji komercyjnych. Można ją swobodnie integrować, modyfikować, wdrażać w produktach i oferować jako usługę, bez konieczności udostępniania kodu źródłowego czy dzielenia się wprowadzonymi zmianami.

    To otwiera zupełnie nowe możliwości. Deweloperzy mogą teraz bez obaw wbudowywać zaawansowane AI lokalnie w narzędzia do web developmentu, systemy DevOps czy aplikacje typu "vibe coding". Modele brzegowe idealnie nadają się do integracji z przeglądarkami przez WebGPU, a większe modele można hostować w chmurze na pojedynczych kartach graficznych klasy konsumenckiej. Google podkreśla, że to "najbardziej wydajna rodzina otwartych modeli", która ma przyspieszyć innowacje w obszarze rozwiązań agentowych i IoT.

    Podsumowanie

    Premiera Gemmy 4 to strategiczny ruch Google, który stawia na efektywność i dostępność. Zamiast brać udział w wyścigu na liczbę parametrów, firma oferuje starannie zaprojektowaną rodzinę modeli, z których każdy ma jasne zastosowanie. Połączenie najwyższej klasy wydajności w benchmarkach, multimodalności i – przede wszystkim – wolnej licencji czyni z Gemmy 4 niezwykle atrakcyjną platformę do budowy przyszłych aplikacji AI. Dostępna od ręki dla deweloperów, może stać się fundamentem nowej fali innowacji, tym razem rozgrywającej się poza centrami danych, bliżej użytkownika.

  • ChatGPT Pro Lite: OpenAI Testuje Nowy Plan Za 100 Dolarów Miesięcznie

    ChatGPT Pro Lite: OpenAI Testuje Nowy Plan Za 100 Dolarów Miesięcznie

    Dla użytkowników, którzy potrzebują czegoś więcej niż oferta Plus za 20 dolarów, ale nie chcą inwestować aż 200 dolarów w pełny plan Pro, może pojawić się nowa opcja. W lutym 2025 roku w kodzie interfejsu webowego ChatGPT wykryto ślady nowego, nieoficjalnego planu subskrypcyjnego o nazwie ChatGPT Pro Lite. Jego miesięczna cena ma wynosić 100 dolarów, co stanowiłoby wyraźne wypełnienie luki między obecnymi pakietami.

    To odkrycie, dokonane przez dewelopera Tibora Blaho, pokazuje, że OpenAI analizuje potrzeby rynku i rozważa dywersyfikację swojej oferty. Szczegóły, które wyciekły z kodu źródłowego, rysują obraz subskrypcji skrojonej pod wymagających użytkowników indywidualnych oraz małe i średnie firmy.

    Co może zaoferować plan za 100 dolarów?

    Na podstawie analizy kodu można wywnioskować kluczowe funkcje, które miałby oferować ChatGPT Pro Lite. Główną obietnicą jest nieograniczony dostęp do najlepszych modeli OpenAI dostępnych w interfejsie użytkownika. Oznaczałoby to brak blokad przy korzystaniu z najpotężniejszych iteracji GPT.

    Co ciekawe, plan miałby również znosić limity dla zaawansowanych funkcji głosowych oraz generowania obrazów i wideo. Dla profesjonalistów pracujących z kodem kluczowa może być wyższa wydajność agentów Codex, co znacząco przyspieszyłoby pracę podczas programowania. Najważniejszym udogodnieniem są jednak podwyższone limity dla tzw. głębokiego rozumowania (Deep Research). W porównaniu do planu Plus limity te miałyby być od 3 do 5 razy większe, pozwalając na intensywniejszą analizę złożonych zagadnień, dokumentów czy kodu źródłowego.

    Dla kogo jest ta oferta?

    ChatGPT Pro Lite zdaje się celować w specyficzną niszę. To opcja dla deweloperów, analityków danych, badaczy czy twórców treści, których potrzeby wykraczają poza standardową ofertę, ale nie wymagają jeszcze pełnego planu Pro. Plan Pro oferuje bowiem aż 20-krotnie wyższe limity w porównaniu do wersji Plus, co dla wielu użytkowników jest przeskalowaniem.

    Nowy pakiet za 100 dolarów stanowiłby więc logiczny krok pośredni. W kontekście biznesowym mógłby być opłacalny dla osób intensywnie korzystających z zaawansowanych funkcji AI w codziennej pracy, dla których podstawowy Plus jest zbyt ograniczający, a koszt Pro – zbyt wysoki. W gruncie rzeczy jest to odpowiedź na coraz większe zróżnicowanie potrzeb użytkowników, którzy od AI oczekują już nie tylko ciekawostki, ale realnego narzędzia zwiększającego produktywność.

    Kontekst rynkowy i struktura cenowa

    Wprowadzenie ChatGPT Pro Lite wpisuje się w szerszą strategię OpenAI, która stale rozbudowuje portfolio subskrypcji. Obecnie, poza darmowym planem Free, użytkownicy mogą wybierać spośród kilku opcji. Plan Go (ok. 8 USD w USA, z lokalnymi dostosowaniami cenowymi, np. ok. 35 zł w Polsce) jest dostępny w wybranych krajach i oferuje rozszerzone możliwości. Flagowy plan Plus za 20 dolarów (ok. 80–90 zł w Polsce) to standard dla zaawansowanych użytkowników indywidualnych. Na szczycie oferty dla klientów indywidualnych stoi właśnie Pro za 200 USD (ok. 800–900 zł w Polsce), oferujący topowe modele OpenAI i ogromne limity. Pełna oferta obejmuje także plany Team, Business oraz Enterprise.

    W tym układzie ChatGPT Pro Lite za 100 dolarów zajmuje wyraźną pozycję pośrodku stawki. Pozwala to OpenAI konkurować w różnych przedziałach cenowych z innymi gigantami, takimi jak Claude Max (do 200 USD) czy Gemini AI Ultra (249,99 USD). Dla polskiego użytkownika cena, szacowana proporcjonalnie na około 400–500 złotych miesięcznie, stawia tę subskrypcję w kategorii poważnego narzędzia biznesowego.

    Podsumowanie

    Wykrycie śladów ChatGPT Pro Lite w kodzie źródłowym to wyraźna sugestia, że OpenAI testuje reakcję rynku na nowy poziom subskrypcji. Oficjalna premiera nie została potwierdzona, więc szczegóły oferty mogą się jeszcze zmienić. Niemniej sam fakt rozważania takiego planu pokazuje, jak dojrzały stał się rynek zaawansowanych asystentów AI. Firmy i profesjonaliści nie szukają już tylko zabawki, lecz wydajnych, skalowalnych narzędzi, a dostawcy tacy jak OpenAI muszą na to odpowiedzieć zróżnicowaną ofertą. Jeśli plan wejdzie w życie, może stać się popularnym wyborem dla tych, którzy traktują ChatGPT jako nieodzowny element swojego warsztatu pracy.

  • Gemma 4 od Google: Cztery Modele Open-Weight Zmieniające Rozgrywkę w AI

    Gemma 4 od Google: Cztery Modele Open-Weight Zmieniające Rozgrywkę w AI

    Google udostępniło rodzinę modeli Gemma 4, składającą się z czterech multimodalnych systemów AI typu open-weight. Wszystkie są objęte licencją Apache 2.0, ale to nie otwartość jest ich największą bronią. Jest nią inteligencja i wydajność, która – jak pokazują benchmarki – pozwala im rywalizować ze znacznie większymi modelami. To kolejny mocny krok w stronę demokratyzacji zaawansowanej sztucznej inteligencji, szczególnie w kluczowych obszarach: AI na urządzenia brzegowe (edge) oraz agentic AI.

    Frontier-Level Performance w różnych skalach

    Nie ma jednego uniwersalnego modelu Gemma 4. Google stworzyło cztery warianty precyzynie dopasowane do różnych potrzeb i możliwości sprzętowych.

    • Effective 2B (E2B) i Effective 4B (E4B) są skrojone pod świat mobile i edge computing. Priorytetem jest tu niska latencja i multimodalność (obsługa tekstu i obrazów). Warianty te oferują również natywny odbiór audio, co umożliwia responsywne przetwarzanie mowy. Mogą działać offline na platformach takich jak Android AI Core, Google AI Edge czy nawet NVIDIA Jetson Nano.
    • 26B A4B (wariant typu Mixture of Experts) oraz 31B Dense trafiają do świata stacji roboczych i serwerów. Wykorzystują hybrydową uwagę (lokalną i globalną) oraz obsługują kontekst do 256K tokenów. Ich siła tkwi w zaawansowanym rozumowaniu logicznym i kodowaniu.

    LMSYS Chatbot Arena mówi jasno: Gemma 4 osiąga poziom „inteligencji na parametr”, który można określić jako frontier-level. Modele plasują się wśród czołowych otwartych rozwiązań na tekstowej tablicy liderów Arena. Model 31B rywalizuje z takimi jednostkami jak Qwen 2.5 72B (w specyficznych zadaniach) czy inne modele o zbliżonej skali, podczas gdy model 26B również zajmuje wysoką pozycję. Oznacza to, że modele w klasie ~30B are już gotowe do złożonych procesów biznesowych (workflows), takich jak agentic search, bez konieczności posiadania niewyobrażalnych zasobów. Modele E2B/E4B, choć małe, radzą sobie wyjątkowo dobrze w ogólnych zadaniach w benchmarkach LMArena.

    Rewolucja dla Edge Computing i Agentic AI

    Rewolucja dla Edge Computing i Agentic AI

    Dwa główne obszary, w których Gemma 4 może zmienić status quo, są ze sobą ściśle powiązane.

    • Edge computing zyskuje potężny napęd. Gemma 4, szczególnie warianty E2B/E4B, pozwala na pełną analitykę on-device AI bez konieczności wysyłania danych do chmury. To nie tylko zerowa latencja, ale fundamentalna zmiana dla przedsiębiorstw i instytucji państwowych dbających o suwerenność danych. Możliwość uruchomienia zaawansowanego modelu multimodalnego (tekst i obraz) na telefonie, Raspberry Pi lub systemie wbudowanym otwiera drogę dla aplikacji, które były dotąd zarezerwowane dla potężnych serwerów: lokalnych asystentów kodujących (vibe coding), agentów analizujących obraz wideo czy transkrypcji audio w czasie rzeczywistym.

    • Agentic AI*(zdolności agentowe) to drugi filar. Gemma 4 nie jest już tylko chatbotem. Modele zostały zaprojektowane do wieloetapowego planowania (multi-step planning) i autonomicznych akcji. Mogą planować sekwencje działań, odpytywać źródła wiedzy (np. Wikipedię) i generować interaktywne treści. To właśnie przejście od statycznej konwersacji do dynamicznego agenta jest kluczem do nowych zastosowań w web devie, DevOps czy analizie danych. Otwarte wagi pozwalają firmom i deweloperom na fine-tuning modeli pod specyficzne, wrażliwe środowiska przy zachowaniu pełnej kontroli.

    Otwarcie drzwi dla deweloperów i „Gemmaverse”

    Od czasu premiery pierwszej Gemmy jej modele zostały pobrane ponad 400 milionów razy, a społeczność stworzyła ponad 100 tysięcy różnych wariantów. Gemma 4 ma szansę rozbudować ten ekosystem – „Gemmaverse” – szczególnie w niszach agentic search i programowania. Otwartość na licencji Apache 2.0, wraz z integracją z Hugging Face i GitHubem, znosi bariery wejścia. Redukuje też koszty sprzętowe w porównaniu do zamkniętych, ogromnych modeli chmurowych.

    Pojawia się tu uzasadniony optymizm. Istnieje realna, rosnąca potrzeba budowania nowych stosów technologicznych (stacks) wokół otwartych modeli, które dają własność i kontrolę nad rozwiązaniem. Gemma 4, ze swoją zróżnicowaną rodziną zoptymalizowaną pod kątem urządzeń brzegowych i serwerów, odpowiada na tę potrzebę w sposób bardzo praktyczny.

    Wnioski

    Premiera Gemma 4 od Google to nie tylko kolejna iteracja modelu. To strategiczne rozszerzenie portfolio, które celuje w najbardziej dynamiczne segmenty rozwoju AI: efektywną pracę na urządzeniach brzegowych i przejście od chatbotów do autonomicznych agentów. Osiągając wydajność klasy frontier-level w stosunku do liczby parametrów, modele te pokazują, że przyszłość może należeć nie tylko do gigantycznych systemów, ale także do inteligentnych, wydajnych i dostępnych lokalnie alternatyw. Dla deweloperów i firm oznacza to większą swobodę, kontrolę i możliwość tworzenia innowacji tam, gdzie wcześniej bariery sprzętowe były nie do przebicia.

  • Google Antigravity 1.21.9: Naprawiono Kluczowy Błąd Blokujący Nowych Użytkowników

    Google Antigravity 1.21.9: Naprawiono Kluczowy Błąd Blokujący Nowych Użytkowników

    Google opublikowało kolejną aktualizację swojego autonomicznego środowiska programistycznego Antigravity. Wersja 1.21.9, wydana 30 marca 2026 roku, koncentruje się na jednej, ale niezwykle istotnej poprawce – usunięciu błędu, który uniemożliwiał nowym użytkownikom dokończenie procesu onboardingu. To wydanie, choć pozornie niewielkie, ma kluczowe znaczenie dla dostępności platformy.

    Dla osób, które dopiero rozpoczynają przygodę z Antigravity, błąd ten stanowił frustrującą barierę. Uniemożliwiał on finalizację konfiguracji i pełne korzystanie z możliwości IDE. Naprawa tej usterki jest więc strategicznym ruchem Google, mającym na celu usunięcie przeszkód stojących na drodze nowych deweloperów, którzy chcą testować paradygmat programowania „agent-first”.

    Czym jest Google Antigravity i dlaczego to ważne?

    Dla szerszego kontekstu warto przypomnieć, czym dokładnie jest Google Antigravity. To zaawansowane, napędzane sztuczną inteligencją zintegrowane środowisko programistyczne (IDE), zaprojektowane specjalnie z myślą o autonomicznym tworzeniu oprogramowania. Zostało zapowiedziane 18 listopada 2025 roku wraz z modelem Gemini 3. Jego istotą jest możliwość delegowania złożonych zadań programistycznych autonomicznym agentom AI, zasilanym głównie przez modele Google: Gemini 3.1 Pro i szybszy Gemini 3 Flash.

    Platforma oferuje dwa główne widoki, które definiują jej filozofię. Widok edytora to klasyczny interfejs IDE z bocznym panelem agenta, podobny do rozwiązań znanych z Cursor czy GitHub Copilot. Z kolei widok managera to centrum kontroli, w którym można zarządzać pracą wielu agentów działających równolegle w różnych workspace'ach. Antigravity jest dostępne bezpłatnie na systemy Windows, macOS i Linux, a co ciekawe, wspiera także zewnętrzne modele, takie jak Claude od Anthropic czy warianty modeli OpenAI.

    Co jeszcze przynoszą ostatnie aktualizacje?

    Choć wersja 1.21.9 skupia się na naprawie onboardingu, tuż po niej, 7 kwietnia, pojawiła się aktualizacja 1.22.2. Wprowadza ona nowy, ujednolicony system uprawnień dla agentów, co stanowi istotny krok w ewolucji kontroli nad autonomicznymi asystentami. Pozwala to deweloperom precyzyjniej zarządzać akcjami, jakie agenci mogą podejmować w projekcie.

    Patrząc na ostatnie wydania, widać wyraźny trend wzmacniania platformy. Wersja 1.21.6 z 25 marca przyniosła długo wyczekiwaną przez społeczność obsługę sandboxingu na Linuxie oraz ulepszenia w uwierzytelnianiu MCP (Model Context Protocol). Sandboxing, czyli uruchamianie poleceń terminala w izolowanym, bezpiecznym środowisku, to kluczowa funkcja bezpieczeństwa, która wcześniej zadebiutowała na macOS. Jej rozszerzenie na Linuksa to ważna wiadomość dla programistów korzystających z tego systemu.

    Poza tym Google stale wprowadza poprawki stabilności, interfejsu użytkownika i wydajności. W poprzednich wersjach pojawiły się też takie funkcje jak umiejętności agentów (Agent Skills), lepsza integracja z Google Workspace dla subskrybentów biznesowych czy natywne wsparcie audio dla asystentów.

    Jak działają aktualizacje i na co uważać?

    Domyślnie Antigravity aktualizuje się automatycznie. Proces ten jest rozłożony w czasie i może zająć kilka dni, zanim dotrze do wszystkich użytkowników. Osoby, które wolą większą kontrolę, mogą wyłączyć automatyczne aktualizacje w ustawieniach, zmieniając Update: Mode na manualny lub całkowicie je blokując.

    Warto mieć na uwadze, że po aktualizacji do wersji 1.21.9 niektórzy użytkownicy zgłaszali problemy z działaniem niektórych poleceń. Szczegóły i skala tego zjawiska nie są jednak do końca jasne na podstawie oficjalnej dokumentacji. To typowy element cyklu życia dynamicznie rozwijanego oprogramowania – nawet krytyczne poprawki mogą czasem wprowadzać nowe, nieprzewidziane interakcje.

    Podsumowanie

    Wydanie Google Antigravity 1.21.9 to przykład pozornie małej, ale strategicznie ważnej poprawki. Usunięcie błędu blokującego onboarding to inwestycja w rozwój społeczności użytkowników. Bez tego nowi deweloperzy mogliby zrezygnować, zanim w ogóle odkryliby potencjał autonomicznego kodowania.

    Ta aktualizacja, wraz z wprowadzeniem sandboxingu na Linuksa i nowego systemu uprawnień, pokazuje, że Google konsekwentnie buduje Antigravity nie tylko jako potężne narzędzie, ale także jako bezpieczną i dostępną platformę. Skupienie się na podstawowych doświadczeniach użytkownika, obok zaawansowanych funkcji agentowych AI, to właściwy kierunek rozwoju tego eksperymentalnego IDE.


    Źródła

  • Claude Wprowadza Kluczowe Zmiany: Koniec Beta 1M Tokenów i Nowe Możliwości API

    Claude Wprowadza Kluczowe Zmiany: Koniec Beta 1M Tokenów i Nowe Możliwości API

    Platforma Claude przechodzi znaczącą aktualizację, która zmienia sposób pracy z długim kontekstem i oferuje deweloperom nowe narzędzia do precyzyjne zarządzania modelami. Najważniejsza zmiana dotyczy okna kontekstowego o rozmiarze 1M tokenów, które wkrótce przestanie być dostępne w wersji beta dla starszych modeli.

    Migracja do najnowszych modeli i koniec ery beta

    Anthropic ogłosiło, że 30 kwietnia 2026 roku zakończy się okres beta dla okna kontekstowego 1M tokenów w starszych modelach Claude. Od tego dnia nagłówek beta context-1m-2025-08-07 przestanie działać dla tych wersji, a żądania przekraczające standardowe limity tokenów będą zwracać błąd. To wyraźny sygnał, że firma skupia rozwój długiego kontekstu na najnowszych modelach.

    Dla deweloperów oznacza to konieczność migracji do najnowszych modeli Claude, które oferują pełne okno 1M tokenów jako standardową funkcję, bez potrzeby używania nagłówków beta i w standardowej cenie. Modele te wykazują znaczący postęp w obsłudze długiego kontekstu w porównaniu z konkurencją.

    Rozszerzone możliwości API i precyzyjne zarządzanie

    Równolegle do zmian w oknie kontekstowym, Anthropic znacząco rozbudowało Models API. Deweloperzy zyskali nowe możliwości, które pozwalają na precyzyjne planowanie implementacji i transparentne zarządzanie tokenami w różnych wariantach modeli. To odpowiedź na realne potrzeby środowiska programistycznego.

    Kolejną praktyczną nowością jest możliwość pominięcia treści procesu rozumowania (extended thinking) w odpowiedziach, co przyspiesza streaming w aplikacjach użytkowników końcowych. Billing pozostaje niezmieniony, a sygnatura jest zachowywana dla zachowania ciągłości w konwersacjach wieloetapowych.

    Inteligentne zarządzanie kontekstem i nowe funkcje

    Najnowsze modele Claude wprowadzają wbudowaną świadomość kontekstu. Potrafią efektywniej zarządzać dostępną przestrzenią tokenów, samodzielnie regulując realizację zadań. To duża zmiana w porównaniu z wcześniejszymi wersjami, które po cichu przycinały nadmiarowy kontekst – teraz modele zwracają błędy walidacji, wymuszając bardziej przemyślane strategie zarządzania danymi.

    Platforma zyskała też zaawansowane funkcje edycji kontekstu po stronie serwera. Deweloperzy mogą teraz usuwać określone elementy z historii konwersacji, zachowując jednocześnie ciągłość rozumowania. Dostępne są również mechanizmy kompaktowania po stronie klienta w popularnych SDK, które generują podsumowania zastępujące pełną historię.

    Podsumowanie: Era dojrzałego długiego kontekstu

    Te zmiany wyznaczają wyraźny kierunek: era eksperymentalnego długiego kontekstu się kończy, a wchodzimy w fazę stabilnych, produkcyjnych implementacji. Migracja do najnowszych modeli nie jest tylko koniecznością techniczną, ale szansą na wykorzystanie dojrzałych funkcji, lepszej wydajności i bardziej przewidywalnego działania. Dla deweloperów oznacza to konieczność przeprowadzenia migracji, ale daje też dostęp do narzędzi, które znacząco ułatwiają budowanie zaawansowanych aplikacji opartych na długich, złożonych konwersacjach z Claude.


    Źródła