Model / Badania
GLM-5.2 trafił na Cloudflare, więc wreszcie da się go przetestować bez własnej serwerowni
GLM-5.2 od Z.ai, model z otwartymi wagami na licencji MIT i 744 miliardami parametrów, trafił do katalogu Workers AI Cloudflare, więc można go odpalić bez własnego sprzętu ani API pod chińskim prawem. Płaci się 1,40 dolara za milion tokenów wejścia i 4,40 za wyjścia, tyle że okno kontekstu ścięto tu do 256 tysięcy tokenów, jednej czwartej reklamowanego miliona. Model prowadzi wśród otwartych wag na rankingu Intelligence Index, lecz w ogólnym rozumowaniu ustępuje OpenAI i Anthropic, a jego taniość ma cichy koszt: około 43 tysięcy tokenów na jedno zadanie.
Napisała AI, żeby oszczędzić Ci czytania setek źródeł. · Jak to działa
Model / Badania · 4 min ·
Cloudflare dołożył GLM-5.2 do katalogu modeli w Workers AI, więc chiński model z otwartymi wagami można teraz odpalić jednym strzałem w REST API albo wpiąć w kod Workers, bez stawiania czegokolwiek u siebie. Dwa tygodnie temu pisałem, że problemem tego modelu nie jest jakość, tylko to, gdzie go w ogóle uruchomić: lokalnie potrzebujesz około 1,5 terabajta pamięci GPU, a tanie API samego Z.ai, twórcy modelu, przepuszcza twój kod przez serwery pod chińskim prawem. Cloudflare jest trzecią drogą, i to najprostszą z dotychczasowych.
Przypomnę, o czym mowa. GLM-5.2 to model firmy Z.ai, 744 miliardy parametrów, wypuszczony na licencji MIT, dziś pierwszy wśród modeli z otwartymi wagami na rankingu Intelligence Index serwisu Artificial Analysis z wynikiem 51 punktów, wyprzedzając MiniMax-M3 i DeepSeek V4 Pro (po 44 punkty). To wiadomo od trzech tygodni. Nowe jest to, że przestał być pozycją w tabeli, a stał się czymś, co realnie podłączysz pod Cursor albo Claude Code i sprawdzisz na własnym repozytorium.
Na Cloudflare płacisz 1,40 dolara za milion tokenów wejścia i 4,40 dolara za milion wyjścia. Co te stawki znaczą na prawdziwej robocie, pokazała Claire Vo, gospodyni podcastu How I AI, w tekście dla Lenny's Newsletter. Puściła GLM-5.2 na cztery zadania w swoim produkcyjnym kodzie na Next.js: audyt architektury, przeprojektowanie strony, wygenerowanie strony z planem projektu i 45-minutową samodzielną sesję łowienia błędów, która sama ściągała logi z Sentry i Vercela. Całość kosztowała ją 3,36 dolara za jakieś 6 milionów tokenów, a na wyjściu dostała działający pulpit z posortowanymi błędami, z którego, jak mówi, realnie wdraża poprawki. Przeprojektowana strona za pierwszym podejściem trafiła w istniejący system wizualny jej produktu, bez rundy poprawek. Sam tytuł mówi resztę: "dlaczego zastępuję Opusa w Claude Code tym modelem".
Czytaj dalej za darmo
Podaj e-mail, aby odblokować pełną treść i cały serwis. Zapiszemy Cię do newslettera.