SmartDigest Tworzone przez AI, żeby nadążyć za AI
Zapisz się

Zapisz się do newslettera

Co tydzień najważniejsze newsy AI prosto na Twój e-mail. Wybierz tematy, które Cię interesują.

Model / Badania

Otwarte wagi, których jeszcze nie ma, a i tak nie odpalisz ich w domu

Alibaba wypuściło Qwen3.8-Max, model z mieszanką ekspertów o 2,4 biliona parametrów, i obiecało w ciągu tygodnia otworzyć jego wagi razem z mniejszym Qwen3.8-27B. Niezależny pomiar Vals AI ostudził zapał: zamiast reklamowanych 86,6 punktu na Terminal-Bench wyszło 67,4, choć w zbiorczym rankingu model i tak zrównał się z Claude Opus 4.7 przy około 2,3 razy niższym koszcie. Otwarte wagi to na razie obietnica bez karty modelu i licencji, a pełny model w kwantyzacji 4-bitowej potrzebuje około 1,2 TB VRAM, więc na własny serwer realnie trafi dopiero mały 27B.

Napisała AI, żeby oszczędzić Ci czytania setek źródeł.  ·  Jak to działa

Model / Badania  ·  4 min  · 

Otwarte wagi, których jeszcze nie ma, a i tak nie odpalisz ich w domu
Ilustrację przygotowała AI.

Alibaba przez lata trzymało najlepsze modele Qwen wyłącznie za API i nigdy nie pokazywało ich wag. Trzeciego sierpnia to się zmieniło. Firma wypuściła Qwen3.8-Max, model o 2,4 biliona parametrów, i zapowiedziała, że w ciągu tygodnia otworzy jego wagi razem z dużo mniejszym Qwen3.8-27B. Po raz pierwszy model z najwyższej półki Max ma trafić na dysk każdego, kto zechce go pobrać. Dla mnie ważniejsze jest co innego: to również pierwszy moment, w którym o tym modelu mówią niezależne pomiary, a nie tylko tabelka producenta.

Szesnaście dni autonomicznego kodu, ale czego dokładnie?

Alibaba oparło premierę na mocnych obrazkach. Model miał przez ponad 10 dni sam zbudować sobie harness, który steruje agentem i decyduje, co ten robi krok po kroku, a potem już przez niego pracować: zbierał zgłoszenia, pisał kod, testował się i poprawiał. Po jakichś 16 dniach takiej pracy repozytorium oh-my-cli urosło do setek commitów i ponad stu pull requestów. Amit Jena, szef rozwoju AI w firmie Kanerika, kwituje to jednym celnym pytaniem: "Szesnaście dni czego? Ile razy wtrącił się człowiek? Czy wynik przeszedł przegląd kodu?" Liczby robią wrażenie, ale nie mówią, ile z tej pracy trzymało się kupy bez nadzoru.

Czytaj dalej za darmo

Podaj e-mail, aby odblokować pełną treść i cały serwis. Zapiszemy Cię do newslettera.

Powiązane

Qwen3.6-27B osiąga to, na co poprzednia generacja potrzebowała 397 miliardów parametrów Model / Badania

Qwen3.6-27B osiąga to, na co poprzednia generacja potrzebowała 397 miliardów parametrów

3 min

Alibaba wypuściła 23 kwietnia Qwen3.6-27B: gęsty model open-source, który na SWE-Bench Verified osiąga 77,2%, ustępując tylko Claude 4.5 Opus (80,9%), a na Terminal-Bench 2.0 remisuje z nim na 59,3%. Przy 15 razy mniejszej liczbie wag niż poprzedni flagowiec Alibaby mieści się w FP8 na karcie z 32 GB, a w kwantyzacji 4-bitowej schodzi na sprzęt konsumencki. Architektura z proporcją 3:1 na korzyść uwagi liniowej daje natywne okno 262 144 tokenów, a opcja preserve_thinking pozwala agentowi nieść ślad rozumowania przez kolejne tury.

Alibaba pokazała szkielet Qwen4, ale wyniki policzyła sobie sama Model / Badania

Alibaba pokazała szkielet Qwen4, ale wyniki policzyła sobie sama

4 min

Alibaba wypuściła na Hugging Face Qwen3.8-Flash-Next, model z otwartymi wagami, w którym przy jednym tokenie pracuje 6 miliardów parametrów ze 125 miliardów, bo wagi rozłożono na 512 ekspertów. Na SWE-bench Pro dostaje 62,5 punktu i wygrywa o 0,8 punktu z gęstym Qwen3.8-27B tej samej firmy, więc przewaga leży w rachunku za token, a nie w jakości odpowiedzi. Tabelę narysowała jednak sama Alibaba, która przed pomiarem poprawiła sobie problematyczne zadania, a niezależnego pomiaru wciąż nie ma. To podgląd architektury pod Qwen4, tyle że po kwantyzacji potrzeba około 65 GB, czyli serwera.

Największy otwarty model świata jest już na szczycie, tylko nie uruchomisz go w domu Model / Badania

Największy otwarty model świata jest już na szczycie, tylko nie uruchomisz go w domu

5 min

Chiński Moonshot AI wypuścił 16 lipca Kimi K3, który tego samego dnia stanął na szczycie Frontend Code Arena z wynikiem 1 679 punktów, 48 oczek przed Claude Fable 5. Z 2,8 biliona parametrów to największy model z otwartymi wagami w historii, ale nikt nie odpali go w domu: pełne wagi zajmą około 1,7 TB, a agresywna kompresja nie schodzi poniżej 650 GB. Znaczenie i tak jest realne, bo otwarte wagi spłaszczają marże, dają wybór, gdzie liczyć, i uczą mniejsze modele przez destylację. Wagi, licencję i raport techniczny obiecano na 27 lipca.