SmartDigest Tworzone przez AI, żeby nadążyć za AI
Zapisz się

Zapisz się do newslettera

Co tydzień najważniejsze newsy AI prosto na Twój e-mail. Wybierz tematy, które Cię interesują.

Model / Badania

Ant Group rozdaje Ling-3.0-Flash za darmo do 3 sierpnia, wagi obiecuje wkrótce potem

Ant Group, firma stojąca za Alipay, wystawiła lekki model Ling-3.0-Flash za darmo na OpenRouter do 3 sierpnia 2026, a otwarte wagi obiecuje wkrótce potem. Model trzyma natywnie 256 tysięcy tokenów kontekstu, rozciąga się do miliona i przy każdym tokenie liczy tylko ułamkiem swoich podsieci, dzięki czemu reklamuje się pod agenty do kodu i pracy z narzędziami. Siedem firmowych nagrań pokazuje wyłącznie udane przebiegi, więc darmowy dostęp i zapowiedź otwartych wag to jedyny fragment tej premiery, którego nie trzeba brać na wiarę.

Napisała AI, żeby oszczędzić Ci czytania setek źródeł.  ·  Jak to działa

Model / Badania  ·  3 min  · 

Ant Group rozdaje Ling-3.0-Flash za darmo do 3 sierpnia, wagi obiecuje wkrótce potem
Ilustrację przygotowała AI.

Ant Group, firma stojąca za chińskim systemem płatności Alipay, wypuściła pod koniec lipca Ling-3.0-Flash, lekki model językowy, i zrobiła jedną rzecz, która naprawdę ma znaczenie dla programisty: postawiła go za darmo na OpenRouter, katalogu, przez który odpalisz cudzy model bez zakładania konta u jego twórcy. Darmowy dostęp trwa do 3 sierpnia 2026, a wagi modelu mają trafić do otwartego pobrania niedługo później. Cała reszta tej premiery to na razie materiał reklamowy samej firmy, i tak bym go traktował.

Dlaczego długie okno kontekstowe kosztuje tu mniej, niż powinno

Techniczny rdzeń brzmi nieźle, dopóki pamięta się, kto go opisuje. Ling-3.0 miesza dwa rodzaje uwagi w proporcji pięć do jednego: większość warstw sięga po tańszą, liniową odmianę, która radzi sobie z długim tekstem bez gwałtownego wzrostu kosztów, a co szósta wraca do pełnej, droższej uwagi, żeby nie stracić precyzji. Dzięki temu model trzyma natywnie 256 tysięcy tokenów kontekstu, czyli mniej więcej tyle, ile mieści spora baza kodu, i potrafi rozciągnąć się aż do miliona. Do tego przy każdym tokenie włącza tylko jedną sześćdziesiątą czwartą swoich wyspecjalizowanych podsieci, więc liczy taniej, niż wskazywałby jego rozmiar.

Czytaj dalej za darmo

Podaj e-mail, aby odblokować pełną treść i cały serwis. Zapiszemy Cię do newslettera.

Powiązane

GLM-5.2 trafił na Cloudflare, więc wreszcie da się go przetestować bez własnej serwerowni Model / Badania

GLM-5.2 trafił na Cloudflare, więc wreszcie da się go przetestować bez własnej serwerowni

4 min

GLM-5.2 od Z.ai, model z otwartymi wagami na licencji MIT i 744 miliardami parametrów, trafił do katalogu Workers AI Cloudflare, więc można go odpalić bez własnego sprzętu ani API pod chińskim prawem. Płaci się 1,40 dolara za milion tokenów wejścia i 4,40 za wyjścia, tyle że okno kontekstu ścięto tu do 256 tysięcy tokenów, jednej czwartej reklamowanego miliona. Model prowadzi wśród otwartych wag na rankingu Intelligence Index, lecz w ogólnym rozumowaniu ustępuje OpenAI i Anthropic, a jego taniość ma cichy koszt: około 43 tysięcy tokenów na jedno zadanie.

Otwarte wagi, których jeszcze nie ma, a i tak nie odpalisz ich w domu Model / Badania

Otwarte wagi, których jeszcze nie ma, a i tak nie odpalisz ich w domu

4 min

Alibaba wypuściło Qwen3.8-Max, model z mieszanką ekspertów o 2,4 biliona parametrów, i obiecało w ciągu tygodnia otworzyć jego wagi razem z mniejszym Qwen3.8-27B. Niezależny pomiar Vals AI ostudził zapał: zamiast reklamowanych 86,6 punktu na Terminal-Bench wyszło 67,4, choć w zbiorczym rankingu model i tak zrównał się z Claude Opus 4.7 przy około 2,3 razy niższym koszcie. Otwarte wagi to na razie obietnica bez karty modelu i licencji, a pełny model w kwantyzacji 4-bitowej potrzebuje około 1,2 TB VRAM, więc na własny serwer realnie trafi dopiero mały 27B.

Pliki wyszukuje model, którego nie ma nawet na liście wyboru Premiera / Narzędzie

Pliki wyszukuje model, którego nie ma nawet na liście wyboru

4 min

Freebuff od CodebuffAI rozbija agenta w terminalu na role: pliki w repozytorium wyszukuje tani Gemini 3.1 Flash Lite, którego nie ma nawet na liście wyboru, a dopiero to, co znajdzie, trafia do modelu piszącego zmiany. Pakiet pięciu narzędzi nie kosztuje nic, bo za dostęp do modeli płacą reklamy, a README wprost przyznaje, że służy do tego treść promptów, i nie podaje ani jednej liczby o jakości. Poza wybranymi regionami zostają dwa modele i trzy sesje na dobę, za to całą orkiestrację napędza otwarty Codebuff, więc ten sam podział ról da się złożyć u siebie, bez reklam.