SmartDigest Tworzone przez AI, żeby nadążyć za AI
Zapisz się

Zapisz się do newslettera

Co tydzień najważniejsze newsy AI prosto na Twój e-mail. Wybierz tematy, które Cię interesują.

Premiera / Narzędzie

MiniMax otworzył kod swojego agenta i pozwala podpiąć pod niego cudzy model

MiniMax udostępnił na licencji MIT kod MCode, agenta programistycznego do terminala, który sam czyta pliki, poprawia kod i uruchamia testy, a przy tym nie wymaga modelu tej firmy, bo jednym poleceniem podepniesz dowolny serwer zgodny z API OpenAI albo Anthropic, także własny. Wyszukiwanie w sieci i praca z obrazami nadal zależą jednak od konta i kredytów w MiniMaxie. Wersja 0.4.12 przyjmuje poprawki tylko od współpracowników, a paczka w npm nie musi odpowiadać kodowi z GitHuba, więc do systemu CI lepiej zbudować agenta ze źródeł.

Napisała AI, żeby oszczędzić Ci czytania setek źródeł.  ·  Jak to działa

Premiera / Narzędzie  ·  4 min  · 

MiniMax otworzył kod swojego agenta i pozwala podpiąć pod niego cudzy model
Ilustrację przygotowała AI.

MiniMax, chińska firma znana dotąd głównie z tanich modeli językowych, opublikowała na GitHubie kod agenta programistycznego MCode, a własny kod udostępniła na licencji MIT. Agent działa w terminalu i zamiast podpowiadać kolejne linijki w edytorze, sam czyta pliki projektu, zmienia kod i uruchamia testy, kiedy opiszesz mu zadanie zwykłym zdaniem. Dla mnie ważniejsze od samego wydania jest to, że MCode nie wymaga modelu MiniMaxa: podłączysz go do dowolnego serwera, który przyjmuje zapytania w formacie API OpenAI albo Anthropic, także do modelu postawionego u siebie.

Przepięcie agenta na model innego dostawcy albo na własny kosztuje tu naprawdę niewiele. Niezależność od MiniMaxa ma jednak granice, tylko leżą one gdzie indziej: w dodatkach, które nadal dostarcza firma, i w tym, że o kierunku rozwoju narzędzia decyduje na razie wyłącznie ona. Dla kogoś, kto chce oprzeć na MCode codzienną pracę, to właśnie te dwie rzeczy, a nie wybór modelu, rozstrzygną, ile swobody naprawdę dostaje.

Własny model to jedna komenda i dwie liczby

Czytaj dalej za darmo

Podaj e-mail, aby odblokować pełną treść i cały serwis. Zapiszemy Cię do newslettera.

Powiązane

MiniMax sprzedaje już agenta, nie tylko tani model, ale dowodem są głównie dema Premiera / Narzędzie

MiniMax sprzedaje już agenta, nie tylko tani model, ale dowodem są głównie dema

3 min

MiniMax wychodzi poza tani model i sprzedaje agenta pod hasłem "Code is cheap, show me the requirement", ale ogłoszenie to dobrane przez firmę dema, bez benchmarku i wyniku na SWE-Bench. Dla programisty konkretem jest natywna integracja z MCP, dzięki której agent sam sięga do GitHuba, GitLaba, Slacka czy Figmy zamiast ręcznego wklejania. Sam żongluje kilkoma modelami naraz, co, jak przyznaje firma, kosztuje i obniża wydajność, więc hasło o tanim kodzie na razie się nie broni. Jedyny twardy sygnał to fakt, że po niecałych 60 dniach stał się codziennym narzędziem ponad połowy zespołu MiniMaxa.

Agent MiniMaxa: efektowne dema, natywne MCP, zero benchmarku Premiera / Narzędzie

Agent MiniMaxa: efektowne dema, natywne MCP, zero benchmarku

3 min

MiniMax pokazał swojego pierwszego ogólnego agenta pod hasłem "kod nic nie kosztuje, pokaż mi, co ma powstać", ale ogłoszenie to głównie efektowne dema, jak postawiona w trzy minuty interaktywna wersja Luwru, bez jednej porównywalnej liczby: nie ma wyniku na SWE-bench ani żadnego benchmarku kodowania. Jedyny twardy konkret dla programisty to wbudowane MCP, dzięki któremu agent sam sięga do GitHuba, GitLaba czy Figmy. Firma sama przyznaje, że agent żongluje kilkoma modelami naraz, co dokłada kosztu i opóźnień, więc w dniu premiery kod wcale nie jest tani.

M2.7 koduje blisko Opusa i sam stroi swój harness Model / Badania

M2.7 koduje blisko Opusa i sam stroi swój harness

3 min

MiniMax wydał M2.7 pod hasłem samoewolucji, ale sprowadza się ona do tego, że model przez ponad 100 rund sam poprawiał kod swojego harnessu, a nie własny mózg, wyciągając z tego 30% poprawy na wewnętrznych testach. Realnie do ręki dostajesz natywny tryb Agent Teams, w którym agenci trzymają się przypisanych ról z 97% zgodnością, oraz wyniki ocierające się o czołówkę: 55,6% na VIBE-Pro, praktycznie na równi z Opusem 4.6. Haczyk jest ten sam co przy M2.5: wszystkie liczby zmierzył sam producent, więc czy model dorównuje slajdom, rozstrzygnie się dopiero na twoim repozytorium.