SmartDigest.ai Tworzone przez AI, żeby nadążyć za AI
Zapisz się

Zapisz się do newslettera

Co tydzień najważniejsze newsy AI prosto na Twój e-mail. Wybierz tematy, które Cię interesują.

Premiera / Narzędzie

Planista w chmurze i wykonawcy na karcie graficznej w Antigravity SDK

23 września Google dodał do Antigravity SDK obsługę modeli działających na własnym komputerze, na start Gemmy 4 26B na silniku LiteRT, ale też Ollamy czy LM Studio. W pokazie Gemini 3.8 Flash w chmurze rozplanował łatanie trzech modułów, widząc tylko nazwy plików i zużywając 95 tokenów, a kod poprawiały lokalne kopie Gemmy, więc nie opuścił maszyny. Dla firm, które nie mogą wysyłać kodu na zewnątrz, to rozsądny kierunek, choć pokaz jest skromny, a sprzęt potrzebuje ponad 24 GB pamięci karty graficznej.

Napisała AI, żeby oszczędzić Ci czytania setek źródeł.  ·  Jak to działa

Premiera / Narzędzie  ·  3 min  · 

Planista w chmurze i wykonawcy na karcie graficznej w Antigravity SDK
Ilustrację przygotowała AI.

Google ma Antigravity, swoje środowisko programistyczne, w którym agenty AI same planują i wprowadzają zmiany w kodzie, oraz Antigravity SDK, czyli bibliotekę dla Pythona, z której zbudujesz takiego agenta we własnym narzędziu. Do tej pory agent z tego SDK myślał w chmurze, więc każdy plik, który mu pokazałeś, trafiał na serwery Google, a każde pytanie kosztowało tokeny. 23 września Google ogłosił, że SDK potrafi już pracować na modelu uruchomionym na twoim komputerze. Na początek jest to Gemma 4 26B A4B, otwarty model Google, który na twojej karcie graficznej uruchamia LiteRT, firmowy silnik Google do modeli lokalnych. Oznaczenie mówi, że model ma około 26 miliardów parametrów, ale przy każdym kroku pracuje tylko około 4 miliardów z nich, co przyspiesza odpowiedzi, choć cały model i tak musi zmieścić się w pamięci.

Sam agent działający offline mnie nie rusza, bo Ollama i LM Studio, popularne darmowe programy do uruchamiania otwartych modeli na własnym komputerze, pozwalają na to od dawna. Nowy jest układ z pokazu: duży model w chmurze tylko planuje, a ciężką robotę na kodzie wykonują lokalne modele, które niczego nie wysyłają. Uważam, że to rozsądny kierunek dla zespołów, które nie mogą wypuścić kodu poza firmę, ale pokaz, którym Google go uzasadnia, jest bardzo skromny.

Planista w chmurze widzi tylko nazwy plików

Czytaj dalej za darmo

Podaj e-mail, aby odblokować pełną treść i cały serwis. Zapiszemy Cię do newslettera.

Powiązane

Kolejny model roboczy Google w miejscu obiecanego flagowca Model / Badania

Kolejny model roboczy Google w miejscu obiecanego flagowca

3 min

Google wypuścił Gemini 3.7 Flash zaledwie trzy tygodnie po wersji 3.6, znów model roboczy w miejscu obiecywanego flagowego Pro. Skok w benchmarkach jest realny, ale niewielki: na DeepSWE v1.1 wynik rośnie z 49,0% do 65,3%, a w rozumieniu dokumentów model bije Claude Sonnet 5 i GPT-5.6. Prawdziwa zmiana jest w cenie, 0,75 dolara za milion tokenów wejściowych, tyle że OpenAI zbiło stawkę swojej Luny do 0,20 dolara. Ryan Whitwam z Ars Technica pyta wprost, czy to szybszy rozwój, czy tylko szybsze wypuszczanie.

Google daje deweloperom obraz i wideo w Gemini API. Warto najpierw przeczytać drobny druk. Model / Badania

Google daje deweloperom obraz i wideo w Gemini API. Warto najpierw przeczytać drobny druk.

4 min

30 czerwca Google udostępnił przez Gemini API dwa modele do generowania mediów: Nano Banana 2 Lite, który zwraca obraz w cztery sekundy za 0,034 dolara, i Gemini Omni Flash do wideo, którego klip poprawiasz kolejnymi poleceniami w naturalnym języku, po 0,10 dolara za sekundę. Omni Flash to jednak dopiero publiczny podgląd z twardymi limitami: klipy do 10 sekund, chwiejna spójność postaci i API, które przyjmuje referencje wideo, po czym po cichu je ignoruje. Runware sprzedaje ten sam model bez listy oczekujących jako gotowy do produkcji, więc sprawdź sam, co realnie przechodzi przez API.

Google wbudował sterowanie komputerem w model, który i tak już odpalasz Premiera / Narzędzie

Google wbudował sterowanie komputerem w model, który i tak już odpalasz

5 min

Google przeniósł sterowanie komputerem do Gemini 3.5 Flash, czyli szybkiego i taniego modelu, który deweloperzy i tak już mają podpięty pod aplikacje. Zamiast osobnego modelu jeden agent widzi ekran i klika jak człowiek, dzięki czemu wchodzi tam, gdzie nie ma API, choćby w stary firmowy system. Google podaje wynik 78,4% na OSWorld-Verified, ale to deklaracja producenta, nie dowód. Kluczowe zabezpieczenia, czyli potwierdzanie wrażliwych działań i blokada wstrzykniętych instrukcji, są opcjonalne, więc ryzyko spada na deweloperów.