SmartDigest Tworzone przez AI, żeby nadążyć za AI
Zapisz się

Zapisz się do newslettera

Co tydzień najważniejsze newsy AI prosto na Twój e-mail. Wybierz tematy, które Cię interesują.

Model / Badania

Grok 4.7 kosztuje tyle samo za token, ale na zadanie zużywa dwa razy więcej

xAI wypuściło 21 września Groka 4.7 w tej samej cenie co poprzednik, czyli 2 dolary za milion tokenów wejściowych i 6 za milion wyjściowych, ale na najwyższym poziomie rozumowania model zużywa średnio około 81 tysięcy tokenów na zadanie, a Grok 4.6 potrzebował 36 tysięcy. Nowa wersja rzadziej zmyśla i zajmuje czwarte miejsce w rankingu agentów programistycznych Artificial Analysis, choć w Terminal-Bench 4.0 wciąż traci prawie 20 punktów do Fable 5.1. Zanim ustawisz najwyższy poziom na stałe, zmierz na własnych zadaniach, ile tokenów trafi na fakturę.

Napisała AI, żeby oszczędzić Ci czytania setek źródeł.  ·  Jak to działa

Model / Badania  ·  4 min  · 

Grok 4.7 kosztuje tyle samo za token, ale na zadanie zużywa dwa razy więcej
Ilustrację przygotowała AI.

W poniedziałek 21 września xAI wypuściło Grok 4.7 i już w pierwszym akapicie ogłoszenia zapewnia, że zapłacisz za niego tyle samo co za poprzednika, czyli 2 dolary za milion tokenów wejściowych i 6 dolarów za milion wyjściowych. Cennik mówi jednak, ile kosztuje token, a nie ile kosztuje wykonane zadanie. Model można ustawić na jeden z czterech poziomów rozumowania, czyli kazać mu "myśleć" krócej albo dłużej przed odpowiedzią, a dłuższe myślenie oznacza więcej tokenów. Według pomiarów Artificial Analysis, niezależnej firmy testującej modele na własnym zestawie zadań, nowy Grok na najwyższym poziomie rozumowania generuje średnio około 81 tysięcy tokenów na zadanie, podczas gdy Grok 4.6 potrzebował 36 tysięcy. Czytam więc tę premierę tak: model jest wyraźnie lepszy w długiej pracy agentowej, ale hasło o niezmienionej cenie jest prawdziwe tylko na etykiecie.

Przy Groku 4.6 pisałem, że jego głównym argumentem jest cena, a na testach programistycznych wciąż goni rywali. Wersja 4.7 próbuje nadrobić właśnie ten drugi punkt. Od premiery działa w Cursorze, popularnym edytorze kodu z wbudowaną AI, w Grok Build, czyli własnym narzędziu xAI do programowania z agentem, oraz przez API pod identyfikatorem grok-4.7.

Trenowanie na zadaniach liczonych w godzinach

Czytaj dalej za darmo

Podaj e-mail, aby odblokować pełną treść i cały serwis. Zapiszemy Cię do newslettera.

Powiązane

2,49 dolara za zadanie: nowy model SpaceXAI uderza w koszt agentów Model / Badania

2,49 dolara za zadanie: nowy model SpaceXAI uderza w koszt agentów

4 min

SpaceXAI wypuściło Grok 4.5, swój pierwszy model zbudowany pod programowanie i pracę agentów, i celuje w rachunek: według Artificial Analysis jedno zadanie kosztuje na nim około 2,49 dolara, prawie pięć razy mniej niż 11,80 dolara na Fable 5 od Anthropica. Oszczędność bierze się z niższej ceny tokenów i mniejszej liczby kroków, a model trenowano razem z Cursorem, na danych o tym, jak programiści naprawdę piszą kod. Haczyk jest realny: tani token nie znaczy tani efekt, bo Grok 4.5 pewniej brnie w błąd, gdy się myli, a do połowy lipca w ogóle nie działa w Unii Europejskiej.

Najnowszy Grok wchodzi tam, gdzie firmy już mają fakturę Model / Badania

Najnowszy Grok wchodzi tam, gdzie firmy już mają fakturę

4 min

Grok 4.6 trafił 21 sierpnia do Model Garden na Vertex AI, więc zespoły na Google Cloud dopisują go do rachunku, który i tak płacą, zamiast przepychać umowę z nowym dostawcą. Reklamowana stawka 2 dolarów za milion tokenów wejściowych obowiązuje jednak tylko do 200 tysięcy tokenów w zapytaniu, a powyżej progu podwaja się dla całego zapytania. Artificial Analysis wycenia jedno domknięte zadanie na 0,84 dolara przy średnio 53 turach, o połowę krócej niż Claude Opus 5 Max. W tle toczą się trzy postępowania wobec X i SpaceXAI: Ofcomu, brytyjskiego urzędu ochrony danych i Komisji Europejskiej.

Który model taniej dowozi agenta? Nie ten z tańszym tokenem Model / Badania

Który model taniej dowozi agenta? Nie ten z tańszym tokenem

4 min

Dwunastego sierpnia DeepSeek wypuścił V4 Pro, a SpaceXAI Groka 4.6, oba pod pracę agentową, i branża odczytała to jako kolejną wojnę cenową. Ale w teście Composio na 30 trudnych zadaniach Grok zaliczył 23, DeepSeek 18, i przesądza tu nie cennik, tylko koszt jednego udanego zadania: Grok kończył za 0,48 dolara, DeepSeek za 0,60, bo więcej prób wyrzucał do kosza. Wniosek dla kogoś, kto wybiera model pod agenta, jest prosty: liczy się nie cena za milion tokenów, tylko koszt zadania, które naprawdę się udało.