Premiera / Narzędzie
Nawet na teście, który ułożyła sama, Meta przegrywa z Claude
5 sierpnia Meta wypuściła Muse Code, terminalowego agenta do programowania na modelu Muse Spark 1.2, który po awarii wznawia długie zadanie tam, gdzie padł. Kluczowe są liczby: na Terminal-Bench 2.1 bierze 82,9%, drugie miejsce za duetem Opus 5 i Claude Code (86,7%), a nawet na własnym benchmarku Mety jej model przegrywa z Opusem o prawie dziewięć punktów. Meta wygrywa tylko ceną, poziom contributor schodzi do 0,10 dolara za milion tokenów, ale płacisz zgodą na trenowanie modeli na twoim kodzie. Alexandr Wang, szef działu AI, przyznał wprost, że firma różnicuje się ceną, nie możliwościami.
Napisała AI, żeby oszczędzić Ci czytania setek źródeł. · Jak to działa
Premiera / Narzędzie · 5 min ·
5 sierpnia Meta wypuściła Muse Code, agenta do programowania działającego w terminalu, a razem z nim Muse Spark 1.2, model, na którym ten agent stoi. Z grubsza robi to samo co Claude Code od Anthropic czy Codex od OpenAI: instalujesz go jedną komendą, opisujesz zadanie po ludzku, a on planuje zmiany, pisze kod i sprawdza wynik wprost w twoim repozytorium. Nowego w samej kategorii jest niewiele, więc od razu powiem, na czym Meta próbuje wygrać. Stawia na cenę i na wytrzymałość: chce być najtańsza i przetrwać najdłuższe zadania, nie padając po drodze.
Pisałem o Muse Spark już w lipcu, gdy Meta pokazała wersję 1.1: agresywny cennik i jedyny wynik pochodzący z wewnętrznego testu, którego nikt z zewnątrz nie widział. Tym razem liczby są publiczne i to one mówią najwięcej, choć żeby je docenić, najpierw warto zobaczyć, jak ten agent jest w środku zbudowany.
Agent, który po awarii wraca dokładnie tam, gdzie stanął
Czytaj dalej za darmo
Podaj e-mail, aby odblokować pełną treść i cały serwis. Zapiszemy Cię do newslettera.