Tag: google

  • Gemini CLI z drobnymi poprawkami interfejsu i dokumentacji w wersji nightly

    Gemini CLI z drobnymi poprawkami interfejsu i dokumentacji w wersji nightly

    Google wypuściło nową wersję nocną Gemini CLI, oznaczoną jako v0.47.0-nightly.20260609.g0567b25a2. To wydanie koncentruje się na poprawie interfejsu użytkownika oraz uporządkowaniu dokumentacji. Nie wprowadza nowych funkcji, ale te drobne poprawki mogą znacząco wpłynąć na postrzeganie narzędzia jako bardziej dopracowanego.

    Co nowego w skrócie

    • Kanał nightly Gemini CLI otrzymał aktualizację v0.47.0-nightly.20260609.g0567b25a2
    • Baner Antigravity zyskał limit wyświetleń, co ograniczy jego powtarzalność
    • Dokumentacja agenta przeglądarkowego straciła etykietę „eksperymentalna”, co sugeruje stabilizację tej funkcji
    • Brak nowych możliwości – zmiany dotyczą jedynie aspektów wizualnych i tekstowych

    Co dokładnie poprawiono

    W notatkach do wydania znajdują się dwie istotne zmiany. Pierwsza dotyczy banera Antigravity, którego maksymalna liczba wyświetleń została zaktualizowana. To poprawka, która z pewnością ucieszy użytkowników Gemini CLI w wersji nightly, ponieważ powtarzające się komunikaty mogą być irytujące. Po osiągnięciu limitu baner znika.

    Druga zmiana to usunięcie słowa „eksperymentalny” z dokumentacji agenta przeglądarkowego. To porządkowanie dokumentacji, które sugeruje, że funkcja automatyzacji przeglądarki osiągnęła poziom dojrzałości, który nie wymaga już oznaczania jej jako eksperymentalnej. Choć Gemini CLI w wersji nightly pozostaje kanałem testowym, zmiana ta poprawia komunikację.

    Nightly, preview, stable – który kanał wybrać

    Gemini CLI w wersji nightly oferuje trzy ścieżki aktualizacji. Nightly to codzienne buildy z najnowszymi zmianami, publikowane o północy UTC. Są to najbardziej ryzykowne wersje, ale dają dostęp do najnowszych funkcji. Preview to wersje pośrednie, które zostały już częściowo przetestowane, a stable to finalne wydania gotowe do produkcji.

    Wersja v0.47.0-nightly wpisuje się w cykl wydawniczy, w którym rodzina v0.47.0 regularnie pojawia się w dziennikach zmian. To typowy rytm dla nocnych buildów, w którym drobne poprawki są wprowadzane codziennie, a część z nich trafia do stabilnego kanału.

    Dlaczego takie aktualizacje mają znaczenie

    Wydania tego typu mogą być łatwe do przeoczenia, ponieważ nie wprowadzają efektownych nowości ani nowych komend. Jednak suma drobnych poprawek w interfejsie i dokumentacji skutkuje płynniejszą pracą. Mniej irytujących banerów i lepsza komunikacja statusu funkcji sprawiają, że narzędzie zyskuje na profesjonalizmie.

    Dla deweloperów korzystających z Gemini CLI w wersji nightly, szczególnie przy integracji agentów przeglądarkowych, ta aktualizacja jest korzystna. Usunięcie etykiety „eksperymentalna” ułatwia przekonanie współpracowników do wdrożenia tych rozwiązań w projektach. Zmiana limitu banera Antigravity sugeruje, że zespół Google analizuje zachowania użytkowników, co może poprawić użyteczność narzędzia.

    Podsumowanie

    Wersja v0.47.0-nightly.20260609.g0567b25a2 to typowa aktualizacja konserwacyjna nocnego kanału Gemini CLI. Dwie zmiany – ograniczenie wyświetleń banera i poprawa dokumentacji agenta przeglądarkowego – nie zmieniają zasadniczo działania narzędzia, ale pokazują, że Google przesuwa niektóre funkcje z fazy eksperymentalnej w stronę dojrzałego produktu. Jeśli korzystasz z Gemini CLI w wersji nightly, aktualizacja jest bezproblemowa i wprowadza więcej porządku do codziennej pracy z CLI.


    Źródła

  • Antigravity 2.0.11: Google łata konflikt z antywirusami i poprawia integrację z IDE

    Antigravity 2.0.11: Google łata konflikt z antywirusami i poprawia integrację z IDE

    Google wydało wersję 2.0.11 swojego narzędzia deweloperskiego Antigravity, eliminując krytyczny błąd, który powodował czarny ekran przy starcie aplikacji. Aktualizacja z 3 czerwca 2026 roku koncentruje się na stabilności, wprowadzając dwie poprawki. Pierwsza z nich rozwiązuje konflikt z niektórymi programami antywirusowymi, a druga poprawia działanie przycisku Open IDE. Choć to wydanie nie wprowadza nowych funkcji, jest kluczowe dla użytkowników, którzy mieli problemy z uruchomieniem aplikacji.

    Co warto wiedzieć o aktualizacji

    • Konflikt z antywirusami został rozwiązany — aplikacja nie zawiesza się już na czarnym ekranie podczas uruchamiania w obecności niektórych programów zabezpieczających.
    • Przycisk Open IDE otrzymał poprawki stabilności, co ułatwia przechodzenie między agentem a edytorem kodu.
    • Brak nowych funkcji — to wydanie zawiera tylko dwie poprawki błędów, bez zmian w interfejsie czy wydajności.
    • Aktualizacja jest stopniowana — Google rozsyła nową wersję falami, więc dotarcie do wszystkich użytkowników może zająć kilka dni.
    • Dotyczy wszystkich platform — Antigravity działa na macOS, Linux i Windows, a poprawki obejmują każdy z tych systemów.

    Czarny ekran po starcie — co dokładnie naprawiono

    Oficjalny changelog wskazuje: „Naprawiono problem występujący po zainstalowaniu określonych produktów antywirusowych, który powodował wyświetlanie ciemnego, pustego ekranu podczas uruchamiania aplikacji”. Użytkownicy, którzy doświadczyli tego błędu, nie mogli przejść dalej, ponieważ aplikacja startowała, ale zamiast interfejsu pokazywała czarną otchłań.

    Szczegóły techniczne nie są publicznie dostępne. Google nie wskazało konkretnych programów antywirusowych, które wywoływały konflikt. Można jednak przypuszczać, że chodziło o mechanizmy heurystyczne lub sandboxing, które blokowały procesy Antigravity odpowiedzialne za renderowanie interfejsu. Tego typu problemy są znane w aplikacjach Electron, gdzie antywirus może fałszywie oznaczyć proces renderujący jako podejrzany. Po aktualizacji do 2.0.11 użytkownicy z aktywną ochroną antywirusową powinni wreszcie zobaczyć normalny ekran startowy.

    Dlaczego przycisk Open IDE ma znaczenie

    Druga poprawka dotyczy przycisku Open IDE, który jest kluczowym elementem przepływu pracy w Antigravity. Narzędzie to działa jako samodzielny agent, potrafiąc analizować kod, generować zmiany i wykonywać zadania. Programiści często chcą wrócić do edytora, aby ręcznie poprawić szczegóły lub przejrzeć wygenerowane pliki.

    Przycisk Open IDE umożliwia otwarcie bieżącego projektu w zintegrowanym środowisku za pomocą jednego kliknięcia. Wersja 2.0.11 naprawia „pewne błędy związane z przyciskiem Open IDE”, co ma zapewnić bardziej niezawodne przejście z warstwy agentowej do edycji kodu. Dla programistów, którzy często przełączają się między agentem a IDE, to realna oszczędność czasu i zmniejszenie frustracji.

    Kontekst większego obrazu

    Antigravity 2.0.11 pojawiło się w maju 2026 roku jako gruntownie przeprojektowane narzędzie, które rozdzieliło monolityczne IDE na osobne komponenty: agenta i edytor. Ta zmiana architektury przyniosła nowe możliwości, ale także problemy, takie jak znikanie historii konwersacji, problemy z integracją WSL czy konflikty z plikami wykonywalnymi.

    Wersja 2.0.11 wpisuje się w stabilizacyjny trend ostatnich tygodni. Poprzednie wydania również koncentrowały się na poprawkach błędów, a nie na dodawaniu funkcji. Wygląda na to, że Google systematycznie rozwiązuje zgłoszone problemy, zanim wróci do rozwijania funkcjonalności. Dla deweloperów używających Antigravity na co dzień to dobra wiadomość — mniej niespodzianek, więcej przewidywalności.


    Źródła

  • Gemini CLI z nową łatką stabilności – wersja v0.46.0-preview.1 już dostępna

    Gemini CLI z nową łatką stabilności – wersja v0.46.0-preview.1 już dostępna

    Google wypuściło nową wersję preview swojego terminalowego agenta AI – Gemini CLI v0.46.0-preview.1. Ta aktualizacja koncentruje się na usunięciu błędu, który mógł prowadzić do niespójności wersji w środowisku deweloperskim. Poprawka została wydana kilka dni po większym wydaniu v0.46.0-preview, które wprowadziło istotne zmiany w architekturze narzędzia.

    Kluczowe informacje

    • Gemini CLI v0.46.0-preview.1 to łatka naprawcza, która zapewnia spójność wersji i stabilność po poprzednim wydaniu preview.
    • Wersja v0.46.0-preview.1 wprowadziła wzmocnioną obsługę zmiany rozmiaru PTY, eliminującą krytyczne awarie natywne.
    • Naprawiono pętle spamowe w interfejsie CLI, które mogły skutecznie zablokować pracę z narzędziem.
    • Zespół Google zachęca użytkowników kanału preview do natychmiastowej aktualizacji.
    • Gemini CLI to open-source'owy agent AI, który integruje modele Gemini bezpośrednio z terminalem.

    Co konkretnie naprawiono

    Wersja v0.46.0-preview.1 jest odpowiedzią zespołu na problemy zgłaszane przez społeczność. Głównym celem łatki było załatanie luki, która powodowała rozjeżdżanie się numerów wersji między różnymi komponentami narzędzia. W praktyce oznaczało to, że niektórzy deweloperzy mieli trudności z poprawną identyfikacją zainstalowanego builda, co utrudniało diagnostykę błędów i raportowanie problemów.

    Poprzednie wydanie – v0.46.0-preview – wprowadziło znaczące zmiany. Inżynierowie Google przeprojektowali obsługę PTY (pseudo-terminali), co jest kluczowe dla komunikacji między procesami w terminalu. Wcześniej zmiana rozmiaru okna terminala mogła prowadzić do poważnych awarii. Teraz ten scenariusz jest obsługiwany w sposób bezpieczny.

    Koniec ze spamem w konsoli

    Koniec ze spamem w konsoli

    Drugim problemem, który został rozwiązany w poprzedniej wersji, były pętle spamowe. Użytkownicy zgłaszali przypadki, w których Gemini CLI wpadał w niekontrolowaną pętlę generowania komunikatów, zalewając konsolę powtarzającymi się wpisami. Problem występował głównie podczas dłuższych sesji i w specyficznych konfiguracjach narzędzia.

    Wersja v0.46.0-preview.1 wprowadziła mechanizmy zapobiegające tym zapętleniom, a obecna łatka konsoliduje te zmiany, zapewniając spójność w ramach ekosystemu wersji. To klasyczny cykl wydawniczy Google dla Gemini CLI – najpierw większa aktualizacja z nowymi funkcjami, a następnie szybka łatka eliminująca wykryte nieścisłości.

    Jak zaktualizować

    Jak zaktualizować

    Gemini CLI jest dostępne jako pakiet npm, więc aktualizacja do wersji preview sprowadza się do jednego polecenia:

    npm install -g @google/gemini-cli@preview

    Po instalacji narzędzie uruchamia się standardową komendą gemini w terminalu. Należy pamiętać, że kanał preview nie jest w pełni zweryfikowany – mogą wystąpić regresje lub inne błędy. Dlatego zespół Google prosi użytkowników o testowanie i zgłaszanie problemów. Dla środowisk produkcyjnych nadal zalecany jest kanał stable, który przechodzi pełny cykl walidacji.

    Szerszy kontekst

    Gemini CLI to interesujący projekt w ekosystemie narzędzi AI dla deweloperów. W przeciwieństwie do rozwiązań zintegrowanych z IDE, działa całkowicie w terminalu, co doceniają osoby pracujące na zdalnych serwerach lub w środowiskach bez interfejsu graficznego.

    Narzędzie rozwija się dynamicznie, a Google stosuje przejrzysty model wydawniczy: codzienne buildy "nightly", cotygodniowe promocje do preview i stabilne wydania po tygodniu testów. Dzięki temu społeczność ma stały dostęp do najnowszych funkcji, a jednocześnie istnieje bezpieczna ścieżka dla tych, którzy wolą poczekać na sprawdzone wersje.


    Źródła

  • Google Antigravity 2.0.10 załatało błąd kredytów G1 i poprawiło stabilność

    Google Antigravity 2.0.10 załatało błąd kredytów G1 i poprawiło stabilność

    Google wypuściło aktualizację Antigravity 2.0.10, która została wydana 28 maja 2026 roku. Ta wersja koncentruje się na naprawie błędów oraz poprawie niezawodności aplikacji. Zespół rozwiązał przede wszystkim krytyczny problem związany z kredytami G1, który wpływał na historię salda użytkowników.

    • Google wydało wersję 2.0.10 swojej aplikacji Antigravity 28 maja 2026
    • Główną zmianą jest poprawka błędu kredytów G1, który zniekształcał wyświetlanie salda konta
    • Dodatkowo wprowadzono szereg poprawek zwiększających ogólną niezawodność i użyteczność
    • Antigravity 2.0.10 zastąpiło wcześniejsze IDE, zmieniając podejście na aplikację desktopową skoncentrowaną na agentach AI

    Błąd G1 – co dokładnie poprawiono?

    Problem z kredytami G1 był jednym z bardziej irytujących błędów, które pojawiły się po premierze Antigravity 2.0.10. Użytkownicy zauważali różnice między rzeczywistym stanem wykorzystanych jednostek rozliczeniowych a tym, co pokazywał interfejs. W niektórych przypadkach system nie poprawnie odzwierciedlał zużycie kredytów z pakietu Google One. Ta kwestia była już częściowo rozwiązana w łatce 2.0.10, ale nie do końca skutecznie.

    Wersja 2.0.10 zamyka ten temat. Mechanizm śledzenia salda został poprawiony, aby dane wyświetlane w zakładce Models w ustawieniach zgadzały się z rzeczywistym stanem konta. Dla osób intensywnie korzystających z agentów AI ma to praktyczne znaczenie – użytkownicy mogą teraz łatwo sprawdzić, ile kredytów faktycznie zostało, bez konieczności ręcznego przeliczania.

    W changelogu nie podano szczegółów technicznych poprawki. Wpis ogranicza się do stwierdzenia „G1 credit bug fix”. Jednak na podstawie wcześniejszych problemów można przypuszczać, że chodziło o synchronizację między backendem rozliczeniowym a lokalnym stanem aplikacji.

    Niezawodność i użyteczność – zbiorcza kategoria poprawek

    Niezawodność i użyteczność – zbiorcza kategoria poprawek

    Oprócz poprawki G1, Antigravity 2.0.10 przynosi również zbiór poprawek określonych jako „różne usprawnienia niezawodności i użyteczności”. To klasyczny zbiór, w którym Google umieszcza mniejsze poprawki, które nie wymagają osobnego opisywania. W praktyce chodzi prawdopodobnie o stabilniejsze działanie przy przełączaniu konwersacji, mniej awarii przy operacjach na plikach oraz ogólne wygładzenie interfejsu.

    Wersja 2.0.10 nie wprowadza nowych funkcji. Nie ma wsparcia dla PDF-ów (to pojawiło się w 2.0.10), nie ma komendy /btw ani przeprojektowanego ekranu limitów. To inżynieryjne wydanie, które przygotowuje grunt pod późniejsze, bardziej rozbudowane aktualizacje.

    Kontekst: Antigravity 2.0.10 jako następca IDE

    Wersja 2.0.10 pojawia się nieco ponad tydzień po premierze Antigravity 2.0.10, zaprezentowanej na Google I/O 19 maja 2026 roku. Ta premiera była dużą zmianą – Google porzuciło dotychczasowe podejście w stylu IDE i zastąpiło je samodzielną aplikacją desktopową skoncentrowaną na agentach.

    Dla wielu programistów oznaczało to utratę znanych narzędzi – eksploratora plików, terminala czy kontroli wersji wbudowanych w poprzednie środowisko. Dlatego kolejne łatki, takie jak 2.0.10, są niezwykle ważne – stabilizują nowe doświadczenie, podczas gdy zespół odbudowuje funkcjonalności w nowej architekturze.

    Co ciekawe, wersja 2.0.10 dodała integrację z Antigravity IDE, co umożliwia otwieranie projektów w starym środowisku. Wygląda na to, że Google stworzyło most między starym a nowym światem, zamiast całkowicie odcinać użytkowników.

    Co dalej?

    Patrząc na dalszy ciąg changeloga – wersje 2.0.10, 2.0.10 czy 2.0.10 – widać, że tempo rozwoju jest wysokie. Kolejne wydania wprowadzają wsparcie dla PDF-ów, komendę /btw do bocznych pytań w trakcie konwersacji, a nawet odtwarzanie plików audio bezpośrednio w aplikacji.

    Dla osób śledzących rozwój narzędzi AI i środowisk pracy z agentami, Antigravity staje się interesującym przypadkiem. Google stara się zbudować pomost między klasycznym IDE a w pełni agentskim workflow – coś, co konkurencja również próbuje robić, ale na razie bez jednego spójnego produktu. Wersja 2.0.10 to mały, ale solidny krok w stronę stabilności, która jest kluczowa dla funkcji aplikacji.


    Źródła

  • Gemini CLI zyskuje stabilność: nowa wersja preview poprawia zarządzanie sesjami

    Gemini CLI zyskuje stabilność: nowa wersja preview poprawia zarządzanie sesjami

    Google wypuściło nową wersję preview swojego narzędzia Gemini CLI, oznaczoną jako v0.45.0-preview.1. Ta wersja nocna z lipca 2026 roku koncentruje się na stabilności działania oraz lepszej kontroli nad tym, co AI pamięta podczas sesji. Chociaż nie wprowadza spektakularnych nowości wizualnych, zmiany w działaniu są solidne i przemyślane.

    Co nowego w Gemini CLI v0.45.0-preview.1

    • Metadane użycia – CLI pokazuje teraz informacje o zużyciu tokenów, co ułatwia kontrolę kosztów.
    • Sekwencyjne wykonanie narzędzia update_topic – wymuszenie kolejności eliminuje błędy w złożonych sesjach.
    • Stabilność na Termuksie – naprawiono zapętlone restarty, które wcześniej uniemożliwiały pracę na Androidzie.
    • Wyciszenie błędów PTY – zmiana rozmiaru terminala nie generuje już nadmiaru komunikatów.
    • Filtrowanie historii – uproszczone zarządzanie kontekstem pozwala precyzyjniej wznawiać sesje.

    Narzędzia działają przewidywalniej

    Jedną z kluczowych poprawek jest wymuszenie sekwencyjnego wykonania dla narzędzia update_topic. W poprzednich wersjach równoległe operacje na stanie sesji prowadziły do nieprzewidywalnych rezultatów, co mogło zakłócać intensywne kodowanie. Teraz każda aktualizacja tematu czeka na swoją kolej, co pozwala na zachowanie spójności stanu sesji.

    Dla osób praktykujących vibe coding to istotna zmiana. Pracując z AI przez dłuższy czas, nawet drobny błąd kontekstu może wprowadzić chaos w projekcie. Gemini CLI stara się minimalizować takie ryzyko.

    Kolejna poprawka dotyczy wyciszenia błędów związanych ze zmianą rozmiaru okna terminala. To jedna z tych irytujących kwestii, które nie psują funkcjonalności, ale generują wiele zbędnych komunikatów. Teraz te komunikaty są stłumione.

    Lepsza kontrola nad kosztami i sesjami

    Lepsza kontrola nad kosztami i sesjami

    Wersja v0.45.0-preview.1 wprowadza możliwość podejrzenia metadanych użycia bezpośrednio w CLI, co obejmuje informacje o zużyciu tokenów i związanych z tym kosztach API.

    Dla zespołów pracujących z hostingiem AI i infrastrukturą chmurową to oszczędność czasu. Nie trzeba już przeskakiwać do zewnętrznych paneli, aby sprawdzić koszty ostatniej sesji. Wszystko jest widoczne w terminalu, co ułatwia podejmowanie decyzji i optymalizację zapytań.

    Android i MCP – mniej awarii, więcej bezpieczeństwa

    Naprawa pętli restartów na Termuksie to ważna zmiana dla deweloperów pracujących na urządzeniach z Androidem. Wcześniej CLI mogło restartować się w nieskończoność bez prawidłowego startu, co uniemożliwiało jego użycie. Teraz ten błąd został usunięty.

    Dodatkowo poprawiono bezpieczeństwo list narzędzi MCP (Model Context Protocol) oraz zoptymalizowano automatyczny routing, co wpływa na niezawodność narzędzia.

    Co to oznacza dla codziennej pracy

    Nowe wydanie Gemini CLI to zestaw przemyślanych poprawek, które sprawiają, że praca z narzędziem staje się płynniejsza. Wymuszenie sekwencyjności, filtrowanie historii sesji i metadane użycia to elementy, które będą szczególnie przydatne podczas dłuższych projektów. Niezależnie od tego, czy używasz Gemini CLI do szybkich zadań, czy wielogodzinnych sesji programistycznych, stabilność jest kluczowa.


    Źródła

  • Google wprowadza Gemini 3.5 Flash: szybki model agentowy dla programistów

    Google wprowadza Gemini 3.5 Flash: szybki model agentowy dla programistów

    Google ogłosił, że jego nowy model sztucznej inteligencji, Gemini 3.5 Flash, jest teraz dostępny dla wszystkich. Model ten, który zadebiutował 19 maja 2026 roku, jest zaprezentowany jako najszybsza i najbardziej opłacalna opcja w ofercie Google, stworzona z myślą o złożonych zadaniach agentowych oraz programistycznych. To stabilne narzędzie, gotowe do zastosowania na dużą skalę, skierowane jest głównie do deweloperów i zespołów DevOps.

    Gemini 3.5 Flash to model „Flash-tier”, co oznacza, że koncentruje się na niskich opóźnieniach i przystępnych kosztach, przy zachowaniu solidnej wydajności. Jego wyróżnikiem jest kontekst sięgający 1 miliona tokenów oraz możliwość generowania odpowiedzi o długości do 65 536 tokenów. Google zoptymalizował ten model pod kątem długich, wieloetapowych przepływów pracy, iteracyjnego debugowania kodu oraz efektywnego wykorzystywania narzędzi.

    Kluczowe informacje o modelu

    • Status i data: Model jest ogólnie dostępny (GA) od 19 maja 2026 roku.
    • Moc obliczeniowa: Obsługuje 1 048 576 tokenów kontekstu i do 65 536 tokenów wyjścia.
    • Multimodalność: Akceptuje dane wejściowe w formie tekstu, kodu, obrazów, audio, wideo i PDF, generując tekst.
    • Ograniczenia: Nie obsługuje jeszcze Gemini Live API, Content Credentials (C2PA) ani funkcji Computer Use.

    Siła w zadaniach agentowych i kodowaniu

    Podstawową filozofią Gemini 3.5 Flash jest wspieranie „agentycznego wykonywania”. Model działa jak autonomiczny asystent, który planuje, dzieli problem na etapy i używa narzędzi do znalezienia rozwiązania. Dla programistów oznacza to bardziej niezawodnego partnera do refaktoryzacji dużych fragmentów kodu, pisania testów czy analizy całego repozytorium, dzięki dużemu oknu kontekstu.

    Nowością jest funkcja „zachowania myśli” (thought preservation), która przechowuje kontekst rozumowania między kolejnymi turami konwersacji. Może to poprawić wyniki w skomplikowanych, iteracyjnych zadaniach, choć Google zauważa, że może również zwiększyć zużycie tokenów. To podejście sprawdza się w sytuacjach wymagających ciągłości rozumowania, na przykład przy poprawianiu błędów i optymalizacji kodu.

    Wydajność, szybkość i koszty

    Nieoficjalne testy wskazują, że Gemini 3.5 Flash jest znacznie szybszy od swojego poprzednika, osiągając ponad 280 tokenów wyjściowych na sekundę w niektórych konfiguracjach testowych. Jednak ta szybkość i poprawiona inteligencja wiążą się z wyższymi kosztami.

    Szacuje się, że nowy model może być nawet pięciokrotnie droższy w eksploatacji w niektórych scenariuszach benchmarkowych w porównaniu do Gemini 3.5 Flash. Wynika to z wyższej ceny bazowej oraz potencjalnie większego zużycia tokenów przez zaawansowane rozumowanie. Przewidywane ceny to 1,50 USD za 1 milion tokenów wejściowych i 9,00 USD za 1 milion tokenów wyjściowych, z 90% zniżką dla tokenów z cache’a.

    Dlaczego to ważne dla świata web dev i AI?

    Dla społeczności zajmującej się rozwojem webowym, vibe codingu i DevOps, wprowadzenie Gemini 3.5 Flash to istotna wiadomość. Bezpośrednia optymalizacja pod kątem kodowania i długich zadań agentowych czyni go potencjalnie idealnym silnikiem dla zaawansowanych asystentów programistycznych lub autonomicznych narzędzi deploymentu.

    Status GA (general availability) oraz deklarowana gotowość do skalowania w produkcji to zielone światło dla zespołów SaaS i platform hostingowych, które chcą integrować zaawansowane AI bez obaw o niestabilność wersji beta. Możliwość przetwarzania dokumentów PDF, wideo czy audio otwiera także drogę do tworzenia agentów analizujących dokumentację techniczną, logi czy nagrania ze spotkań.

    Podsumowanie

    Gemini 3.5 Flash to odpowiedź Google na rosnące zapotrzebowanie rynku na szybkie, niezawodne i myślące modele AI do zastosowań produkcyjnych. Choć wiąże się z wyższą ceną niż poprzednia generacja, oferuje znaczący postęp w inteligencji, zwłaszcza w obszarze zadań agentowych i programistycznych. Dla deweloperów i inżynierów AI stwarza nowe możliwości budowania bardziej złożonych i samodzielnych aplikacji, które potrafią nie tylko odpowiadać, ale także planować i wykonywać wieloetapowe procesy. Jego prawdziwa wartość ujawni się w praktyce, gdy zespoły zaczną wykorzystywać długi kontekst i domyślne rozumowanie do automatyzacji skomplikowanych przepływów pracy.

  • Gemini CLI v0.39.0-nightly.20260409: lepsza kontrola i wydajność dla nocnej wersji

    Gemini CLI v0.39.0-nightly.20260409: lepsza kontrola i wydajność dla nocnej wersji

    Google wydało nową nocną wersję swojego narzędzia AI działającego w terminalu — Gemini CLI v0.39.0-nightly.20260409. Aktualizacja koncentruje się na zwiększeniu kontroli użytkownika nad agentem, poprawie wydajności systemu oraz usunięciu kilku kluczowych błędów, które utrudniały pracę. Dla deweloperów i entuzjastów web devu oraz AI oznacza to bardziej stabilne i przewidywalne środowisko pracy bezpośrednio z linii poleceń.

    Wśród najważniejszych zmian widać wyraźny nacisk na bezpieczeństwo operacji. Tryb Plan, w którym AI może autonomicznie planować zadania, teraz wymaga od użytkownika ręcznego potwierdzenia przed aktywacją każdej umiejętności. To istotna zmiana, która pozwala na lepszą kontrolę nad bardziej złożonymi, automatycznymi workflow. Dopracowano także formatowanie wyjścia narzędzi oraz obsługę klawiszy w Windows Terminal, rozwiązując problem z usuwaniem całych słów za pomocą Ctrl+Backspace.

    Kluczowe zmiany w nocnej wersji 0.39.0

    • Wzmocniona kontrola w trybie Plan: Wprowadzono obowiązkowe potwierdzenie użytkownika dla aktywacji umiejętności, co daje większą władzę nad działaniami agenta.
    • Poprawki dla Windows Terminal i stabilności sesji: Naprawiono błąd uniemożliwiający usuwanie całych słów (Ctrl+Backspace) w Windows Terminal oraz problemy z wznawianiem zawieszonych sesji.
    • Wydajność i optymalizacja: Dodano nowe mechanizmy testowania zużycia pamięci i CPU, aby zapobiegać regresjom wydajności.
    • Bezpieczeństwo sandboxa: Wdrożono refaktoryzację sandboxa Seatbelt dla macOS oraz naprawiono problemy z symlinkami na Windows, co zwiększa izolację i bezpieczeństwo wykonywanych operacji.

    Ta nocna wersja to nie tylko poprawki, ale także rozwój infrastruktury testowej. Zespół dodał zaawansowane testy integracyjne mierzące zużycie pamięci i wydajność procesora, co pokazuje dbałość o długoterminową stabilność projektu.

    Dla użytkowników oznacza to bardziej responsywne działanie CLI. Szczególnie ważna dla programistów pracujących na Windowsie jest poprawka w Windows Terminal, która przywraca intuicyjne edytowanie linii poleceń.

    Rozwój ekosystemu i przyszłość

    Wydanie wpisuje się w szerszy trend rozwoju Gemini CLI jako platformy. Widać inwestycję w rozszerzalność i dalsze prace nad integracją z MCP serverami. Projekt, będący open source, aktywnie rozwija społeczność, co potwierdza długa lista pull requestów od wielu kontrybutorów.

    Choć wersja nightly jest przeznaczona dla użytkowników chcących testować najnowsze, czasem niestabilne funkcje, to wprowadzone w wersji 0.39.0 poprawki są niezwykle praktyczne. Niektóre z nich, jak naprawa Ctrl+Backspace na Windowsie, były wyczekiwane przez długi czas. To pokazuje, że zespół nie tylko dodaje nowe, eksperymentalne możliwości, ale także słucha społeczności i troszczy się o codzienny komfort pracy.

    Dla deweloperów zainteresowanych AI, web devem czy automatyzacją zadań devopsowych, Gemini CLI staje się coraz bardziej dojrzałym narzędziem. Ta nocna aktualizacja, skoncentrowana na kontroli i wydajności, to krok w kierunku zapewnienia stabilności potrzebnej do profesjonalnego wykorzystania AI w terminalu. Warto obserwować dalsze zmiany, zwłaszcza w stabilnych wydaniach, które powinny wkrótce wchłonąć te ulepszenia.


    Źródła

  • Google uwalnia potencjał sztucznej inteligencji na Macu. Gemini for Mac już oficjalnie dostępne

    Google uwalnia potencjał sztucznej inteligencji na Macu. Gemini for Mac już oficjalnie dostępne

    Google udostępniło natywną aplikację Gemini na komputery Mac. Program nie jest jedynie kopią wersji przeglądarkowej, ale został napisany od podstaw w języku Swift, co pozwala na integrację z systemem macOS. Użytkownicy mogą korzystać z darmowej wersji z limitami lub wybrać płatne pakiety, takie jak AI Plus, AI Pro czy AI Ultra.

    Aplikacja jest dostępna do pobrania na stronie gemini.google/mac/. Google zdecydowało się ominąć App Store, co pozwala firmie wydawać aktualizacje bez czekania na weryfikację Apple. Do działania wymagany jest komputer z procesorem Apple Silicon oraz system macOS 15 (Sequoia) lub nowszy. Osoby korzystające ze starszych wersji systemu lub komputerów z procesorami Intel nie mogą zainstalować tej wersji.

    Szybkość i analiza treści na ekranie

    Główną zaletą aplikacji jest łatwy dostęp, przypominający działanie systemowej wyszukiwarki Spotlight. Program można wywołać skrótem klawiaturowym Option + Spacja, co otwiera małe okno do szybkich pytań. Pełny czat uruchamia się kombinacją Option + Shift + Spacja. Ikona Gemini jest widoczna w Docku oraz na górnym pasku menu.

    Aplikacja potrafi analizować to, co aktualnie wyświetla się na monitorze. Po włączeniu odpowiednich uprawnień w ustawieniach prywatności i dostępności, Gemini widzi otwarte dokumenty PDF, arkusze kalkulacyjne czy kod w edytorze. Dzięki temu asystent może streścić tekst, wyjaśnić skomplikowane fragmenty danych lub zasugerować poprawki w projekcie graficznym bez konieczności ręcznego kopiowania treści.

    Narzędzia dla twórców i programistów

    Gemini na Maca oferuje te same funkcje, co wersja mobilna i przeglądarkowa. Użytkownicy mogą korzystać z modelu Imagen 3 do generowania obrazów oraz narzędzia Veo do tworzenia krótkich materiałów wideo. Program ułatwia pracę nad projektami kreatywnymi i technicznymi.

    Programiści i osoby pracujące z dużą ilością danych mogą przesyłać pliki bezpośrednio do aplikacji. Gemini pomaga w pisaniu kodu, tłumaczeniu tekstów i planowaniu zadań. Dzięki temu, że aplikacja działa lokalnie jako natywny program, reaguje szybciej niż interfejs w przeglądarce internetowej.

    Konkurencja na rynku

    Wprowadzenie tej aplikacji to ruch wymierzony w ChatGPT Desktop oraz Microsoft Copilot. Google postawiło na ścisłe połączenie asystenta z systemem operacyjnym, co ma przyciągnąć osoby na co dzień korzystające z komputerów Apple.

    Oficjalna premiera odbyła się 16 kwietnia 2024 roku, kończąc okres zamkniętych testów. Od pierwszych zapowiedzi aplikacja została rozbudowana o stabilną analizę ekranu i obsługę plików. Google regularnie dodaje nowe funkcje, dostosowując narzędzie do aktualnych możliwości modeli językowych.

    Dostępność i wymagania

    Gemini na Maca jest skierowane do osób, które chcą mieć dostęp do sztucznej inteligencji bez przełączania się między kartami przeglądarki. Choć wymóg posiadania najnowszego systemu i procesora Apple Silicon ogranicza grono odbiorców, zapewnia to płynne działanie programu.

    Aplikacja obsługuje język polski oraz wszystkie inne języki dostępne wcześniej w wersji mobilnej. Wybór między instalacją aplikacji a korzystaniem z przeglądarki zależy od tego, jak bardzo asystent ma być zintegrowany z codziennymi zadaniami. Google promuje rozwiązanie systemowe jako szybszy i wygodniejszy sposób pracy na Macu.

  • Google łączy siły: NotebookLM teraz głęboko zintegrowany z aplikacją Gemini

    Google łączy siły: NotebookLM teraz głęboko zintegrowany z aplikacją Gemini

    Google wprowadziło zmianę w sposobie korzystania ze swoich narzędzi AI, łącząc NotebookLM bezpośrednio z aplikacją Gemini. NotebookLM, który do tej pory był osobnym programem do analizy dokumentów, jest teraz dostępny z poziomu głównego czatu Gemini. Dzięki temu użytkownicy nie muszą już przełączać się między różnymi kartami przeglądarki, aby pracować na swoich materiałach.

    Obsługa tej funkcji jest prosta. W oknie czatu Gemini, obok ikony dodawania plików, znajduje się przycisk NotebookLM. Po jego kliknięciu można wybrać konkretny notatnik zawierający pliki PDF, artykuły czy transkrypcje z YouTube. Od tego momentu Gemini wykorzystuje te dokumenty jako bazę do udzielania odpowiedzi. AI automatycznie uwzględnia treść źródeł przy tworzeniu streszczeń czy analiz, bez konieczności każdorazowego wklejania tekstu do czatu.

    Jak to działa w praktyce

    Główną korzyścią jest wygoda. Użytkownik rozmawia z Gemini, korzystając z możliwości modelu, a jednocześnie ma pewność, że odpowiedzi opierają się na jego własnych plikach. Aby sprawdzić konkretne źródło lub dodać nowy dokument, wystarczy kliknąć przycisk "źródła". Wszystkie dane i zmiany w notatnikach są aktualizowane na bieżąco.

    Integracja pozwala też na zarządzanie bazą wiedzy bezpośrednio z poziomu Gemini. Można tam dodawać nowe linki i pliki, a także zapisywać fragmenty rozmów bezpośrednio w strukturze notatnika.

    Różnica w sposobie działania

    To połączenie zmienia sposób, w jaki AI przetwarza informacje. Standardowy NotebookLM jest systemem zamkniętym, co oznacza, że odpowiada tylko na podstawie wgranych dokumentów. Wersja wbudowana w Gemini daje większy wybór.

    Użytkownik może zdecydować, czy AI ma trzymać się wyłącznie dostarczonych materiałów, czy może uzupełnić odpowiedź o informacje z internetu. Pozwala to na łączenie precyzyjnej analizy własnych danych z szeroką wiedzą dostępną w sieci.

    Zastosowanie w nauce i pracy

    Połączenie bazy wiedzy NotebookLM z funkcjami konwersacyjnymi Gemini ułatwia pracę osobom zajmującym się analizą danych, studentom i badaczom. Rozwiązuje to problem wyboru między narzędziem do pracy na źródłach a wszechstronnym asystentem AI.

    W edukacji rozwiązanie to wykorzystuje model Gemini z komponentami LearnLM, które są dostosowane do celów dydaktycznych. Nauczyciele mogą dzięki temu sprawniej przygotowywać materiały na podstawie konkretnych podręczników, a studenci mogą analizować literaturę przedmiotu w jednym oknie.

    Nowe możliwości dla użytkowników

    Wprowadzenie NotebookLM do Gemini upraszcza proces badania i gromadzenia informacji. Zamiast korzystać z kilku osobnych narzędzi, użytkownik otrzymuje jedno środowisko, w którym porządkuje źródła i od razu o nie pyta.

    Obecnie funkcja ta jest wdrażana stopniowo, głównie dla użytkowników korzystających z komputerów. Google dąży do ściślejszego powiązania swoich usług AI, co w praktyce oznacza mniej kopiowania danych i szybszy dostęp do własnych notatek podczas rozmowy z botem. Dla osób pracujących z dużą ilością tekstu jest to ułatwienie, które realnie przyspiesza codzienną pracę.

  • Google Gemma 4: Nowa Era Otwartych Modeli AI z Ogromną Mocą

    Google Gemma 4: Nowa Era Otwartych Modeli AI z Ogromną Mocą

    Google właśnie pokazał światu nową generację swoich flagowych, otwartych modeli AI. Gemma 4 to nie zwykła iteracja, lecz zasadniczy skok, który stawia te lekkie konstrukcje w ścisłej czołówce globalnych rankingów, pozwalając im konkurować z modelami wielokrotnie większymi. To wydanie kładzie duży nacisk na zaawansowane rozumowanie i tzw. zdolności agentowe (agentic workflows), czyli umiejętność samodzielnego planowania i wykonywania wieloetapowych zadań przez AI.

    Wydajność nowej rodziny modeli jest imponująca. Wersja 26B typu Mixture of Experts (MoE) plasuje się na 6. miejscu na światowej liście liderów LMSYS Chatbot Arena wśród modeli otwartych. Co najważniejsze, Gemma 4 potrafi wygrywać w benchmarkach z modelami aż 20 razy większymi, co ma kluczowe znaczenie dla praktycznych wdrożeń.

    Rodzina modeli i ich kluczowe możliwości

    Google oferuje Gemmę 4 w czterech precyzyjnie dopasowanych rozmiarach. Są to: Effective 2B (E2B) dla maksymalnej oszczędności pamięci, Effective 4B (E4B) jako kompromis między możliwościami a zasobami na urządzeniach brzegowych (edge devices), oraz 26B MoE (A4B), charakteryzujący się niesamowitą szybkością dzięki aktywacji tylko około 4 miliardów parametrów jednocześnie. Modele E2B i E4B mają odpowiednio około 2,3 mld i 4,5 mld aktywnych parametrów.

    Prawdziwa siła Gemmy 4 leży w jej uniwersalności. Wszystkie modele są natywnie multimodalne – przetwarzają zarówno tekst, jak i obrazy o zmiennym formacie. Każdy z nich radzi sobie także z wideo, a architektura wspiera również dźwięk, co otwiera drogę do zaawansowanej analizy multimodalnej.

    Kluczową nowością jest nacisk na rozumowanie i działania agentowe. Gemma 4 została zaprojektowana od podstaw jako świetny „myśliciel”, potrafiący prowadzić wieloetapowe rozumowanie i planowanie. To właśnie ta cecha, zwykle zarezerwowana dla największych, zamkniętych modeli, jest tu dostępna w lekkiej formie. Dodano też natywne wsparcie dla promptów systemowych (system prompts), co pozwala na bardziej kontrolowane i ustrukturyzowane interakcje z AI.

    Przełom w wydajności i dostępności

    Gemma 4 dokonuje prawdziwej rewolucji w zakresie wydajności na urządzeniach brzegowych. Dzięki ulepszeniom architektonicznym, takim jak Grouped Query Attention (GQA) czy przycięte osadzenia pozycyjne Rotary (p-RoPE), modele działają niezwykle sprawnie. Testy wykazują, że osiągają one wysoką wydajność nawet na ograniczonym sprzęcie. Z kolei przy wykorzystaniu akceleracji dedykowanych jednostek NPU szybkość generowania tekstu wzrasta do tysięcy tokenów na sekundę.

    Rozszerzone okna kontekstowe (context window) – do 128K dla małych modeli i 256K dla średnich – pozwalają na dynamiczną pracę z długimi dokumentami. Inżynierowie odnotowali znaczące przyspieszenie fazy przetwarzania wstępnego (prefills) w modelu E2B. Wszystko to przekłada się na realne korzyści: osiąganie poziomu modeli klasy „frontier” przy ułamku kosztów sprzętowych, możliwość pracy offline, lepszą prywatność i mniejsze opóźnienia.

    Dla programistów Gemma 4 przynosi znaczący postęp w generowaniu kodu i obsłudze wywołań funkcji (function calling), umożliwiając lokalną asystę programistyczną wysokiej jakości. Model wspiera od razu ponad 35 języków, będąc trenowanym na korpusie obejmującym ponad 140 języków, co czyni go narzędziem globalnym.

    Co to oznacza dla rynku AI?

    Wydanie Gemmy 4 na liberalnej licencji Apache 2.0 to jasny sygnał dotyczący strategii Google. Od debiutu pierwszej wersji, modele te cieszą się ogromną popularnością w społeczności, która stworzyła dziesiątki tysięcy ich wariantów. Teraz Google nie tylko dostarcza otwarte alternatywy, ale sprawia, że są one w pełni konkurencyjne pod względem możliwości.

    To posunięcie przyspiesza demokratyzację zaawansowanej sztucznej inteligencji. Firmy i deweloperzy, którzy potrzebowali mocy największych modeli, ale obawiali się kosztów, uzależnienia od chmury (vendor lock-in) lub wymogów prywatności, otrzymują potężne narzędzie do wdrożeń lokalnych i brzegowych. Gemma 4 jest już dostępna wieloma kanałami, w tym przez Hugging Face, Google AI Edge, a także w systemie Android w ramach wersji zapoznawczej AICore dla deweloperów.

    Podsumowanie

    Gemma 4 to coś więcej niż aktualizacja. To dowód na to, że era zaawansowanej sztucznej inteligencji nie musi być zarezerwowana wyłącznie dla gigantycznych, zamkniętych modeli chmurowych. Google, łącząc najnowocześniejsze techniki architektoniczne z filozofią otwartości, stworzył rodzinę modeli, które są jednocześnie potężne, wszechstronne i niezwykle efektywne. Może to zmienić reguły gry, przyspieszając innowacje i pozwalając na budowę inteligentnych aplikacji bezpośrednio na naszych urządzeniach.