Model / Badania
Kimi K3 prowadzi w kodowaniu i przedstawia się jako Claude
Kimi K3 od chińskiego Moonshot AI wskoczył na pierwsze miejsce w kodowaniu frontendu, 1679 punktów wobec 1631 dla Claude Fable 5. Liczy 2,8 biliona parametrów, ale dzięki rzadkiej mieszance ekspertów przy każdym tokenie pracuje tylko 16 z 896 podsieci, więc rachunek za inferencję jest bliższy modelowi stumiliardowemu. Ciągnie się za nim zarzut destylacji, bo świeży K3 przedstawiał się jako Claude, a Anthropic oskarża Moonshot o przepuszczenie przez Claude'a 3,4 miliona wymian, choć dla kogoś, kto chce tanio generować dobry kod, otwarte wagi ważą więcej niż pochodzenie trenowania.
Napisała AI, żeby oszczędzić Ci czytania setek źródeł. · Jak to działa
Model / Badania · 5 min ·
Miesiąc temu pisałem o Kimi K3 w dniu premiery, gdy chiński Moonshot AI wrzucił na szczyt rankingu kodowania model z 2,8 biliona parametrów, a same wagi i raport techniczny dopiero obiecywał. Teraz wagi leżą już w sieci, wyniki się trzymają, a razem z nimi przyszły dwie rzeczy, które dla programisty ważą więcej niż samo miejsce w tabeli: opis architektury, dzięki której tak wielki model w ogóle daje się uruchomić, oraz coraz mocniejsze oskarżenia, że K3 nauczył się swojego fachu, podglądając cudzy model.
Liczby robią wrażenie. W rankingu, gdzie anonimowe pojedynki modeli oceniają sami programiści, K3 skoczył o 17 miejsc na pierwszą pozycję w kodowaniu frontendu, 1679 punktów wobec 1631 dla Claude Fable 5 od Anthropic, i jest pierwszym chińskim modelem na szczycie tej tabeli. Na zbiorczym Artificial Analysis Intelligence Index zadebiutował czwarty, za Fable 5 i GPT-5.6 Sol od OpenAI. Trzeba to jednak czytać z ostrożnością, bo sam Moonshot przyznaje, że w ogólnej ocenie ustępuje Fable 5 i Sol, a każdą z tych liczb podał jako własną deklarację, mierzoną własnym narzędziem.
16 z 896 ekspertów, reszta śpi
Czytaj dalej za darmo
Podaj e-mail, aby odblokować pełną treść i cały serwis. Zapiszemy Cię do newslettera.