OpenCode ujarzmia agentów – lepsza kontrola kroków, nowe warianty GLM-5.2 i szybsze cache’owanie promptów

OpenCode ujarzmia agentów – lepsza kontrola kroków, nowe warianty GLM-5.2 i szybsze cache’owanie promptów

Najnowsza aktualizacja OpenCode (v1.17.9) wprowadza zmiany w zachowaniu agentów AI oraz rozszerza obsługę modeli, co ma na celu częstsze kończenie zadań konkretną odpowiedzią, zamiast ich przerywania. Główne zmiany dotyczą zarządzania krokami agenta, konfiguracji providerów oraz mechanizmów cache’owania, co ma uczynić pracę z kodem bardziej przewidywalną.

Co nowego – kluczowe fakty

  • Agent kończy zadanie finalną odpowiedzią tekstową, co redukuje frustrujące, niedokończone sesje.
  • GLM-5.2 zyskuje nowe warianty myślenia: high i max, umożliwiające głębszą analizę tam, gdzie to potrzebne.
  • Nagłówki providerów są teraz traktowane bez rozróżniania wielkości liter, a ustawienia łączą się warstwowo – od providera, przez model, po wariant.
  • Cache promptów działa skuteczniej, ponieważ follow-upy użytkownika nie są już opakowywane w zbędny steering reminder.
  • Subagent w tle uruchomi się tylko na serwerach wspierających sesje potomne, co eliminuje ciche błędy.

Koniec z niedokończonymi zadaniami

Zmiana, którą odczuje każdy, kto regularnie zleca agentowi dłuższe zadania, dotyczy sposobu finalizowania kroków. Wcześniej agent mógł utknąć w połowie skomplikowanej operacji – brak odpowiedzi, timeout lub cichy błąd. Teraz OpenCode wymusza zakończenie zadania finalną odpowiedzią tekstową. W przypadku problemów użytkownik otrzymuje komunikat, a nie pusty ekran.

Dla zespołów pracujących w trybie vibe coding lub zlecających agentowi dziesiątki zadań dziennie, ta poprawka oszczędza godziny debugowania. Mniej przerwanych sesji to także mniejsze zużycie tokenów – agent nie próbuje bez końca kontynuować tego, co już się rozjechało.

W release note’ach widnieje zapis, że “stop wrapping follow-up user messages in a steering reminder so prompt caching stays effective”. Oznacza to, że wiadomości follow-up nie są już sztucznie rozdmuchiwane, co sprawia, że cache promptów działa efektywniej, a odpowiedzi wracają szybciej.

GLM-5.2 dostaje tryby myślenia – high i max

GLM-5.2 dostaje tryby myślenia – high i max

Drugą istotną nowością jest wsparcie dla wariantów high i max w modelu GLM-5.2. Wybór poziomu “myślenia” pozwala dostosować głębokość analizy do zadania. Jeśli potrzebujesz szybkiej odpowiedzi, pozostajesz przy standardzie. Gdy pracujesz nad architekturą lub skomplikowanym refaktorem, przełączasz na max.

OpenCode zintegrował teraz ustawienia providera, modelu i wariantu w jedną spójną konfigurację. Dokumentacja modeli informuje, że najpierw aplikowane są wartości providera, potem modelu, a na końcu wybranego wariantu. Dla użytkowników własnych providerów (np. przez Helicone czy Cloudflare AI Gateway) to koniec z ręcznym doklejaniem nagłówków w kilku miejscach.

Nagłówki i detekcja modeli bez zbędnego tarcia

Nagłówki i detekcja modeli bez zbędnego tarcia

Dla tych, którzy korzystają z niestandardowych providerów LLM, ważna jest zmiana w obsłudze nagłówków. OpenCode traktuje nazwy nagłówków bez rozróżniania wielkości liter i przepuszcza je przez konfigurację providera. Jeśli używasz zewnętrznej warstwy obserwowalności czy cache’owania (np. Helicone), nagłówki śledzące i cache’owe przechodzą bezproblemowo.

Trwają także prace nad automatyczną detekcją modeli przez endpoint /v1/models. Dla providerów, którzy udostępniają tę ścieżkę, OpenCode sam wyciągnie listę dostępnych modeli, co eliminuje potrzebę ręcznej konfiguracji. Mniej konfiguracji na start to mniej okazji do błędów.

Skrót do subagenta w tle (subagent: true w komendach) został ograniczony tylko do serwerów, które faktycznie wspierają wykonywanie sesji potomnych. Wcześniej próba użycia tej funkcji na niekompatybilnym serwerze kończyła się cichym błędem – teraz OpenCode po prostu nie pozwoli jej wywołać.

Dla kogo to ma znaczenie

Jeśli pracujesz z agentami AI na co dzień – w terminalu, IDE czy desktopie – ta aktualizacja przekłada się na mniej przerw, szybsze odpowiedzi i czytelniejsze komunikaty. Dotyczy to zwłaszcza web developmentu i vibe codingu, gdzie agenci działają niemal non-stop, a każda minuta przestoju kosztuje. Zmiany w cache’owaniu promptów mają również wymiar finansowy – skuteczniejszy cache to mniej zbędnych zapytań do API.

Najnowsza wersja OpenCode to przede wszystkim poprawki pod maską. Nie wprowadza rewolucyjnych zmian w UI, ale oferuje wiele usprawnień, które sprawiają, że narzędzie działa bardziej przewidywalnie. W pracy z kodem przewidywalność jest kluczowa.


Źródła

Komentarze

Dodaj komentarz

Twój adres email nie zostanie opublikowany. Wymagane pola są oznaczone *