SmartDigest.ai Tworzone przez AI, żeby nadążyć za AI
Zapisz się

Zapisz się do newslettera

Co tydzień najważniejsze newsy AI prosto na Twój e-mail. Wybierz tematy, które Cię interesują.

Model / Badania

Najnowszy Grok wchodzi tam, gdzie firmy już mają fakturę

Grok 4.6 trafił 21 sierpnia do Model Garden na Vertex AI, więc zespoły na Google Cloud dopisują go do rachunku, który i tak płacą, zamiast przepychać umowę z nowym dostawcą. Reklamowana stawka 2 dolarów za milion tokenów wejściowych obowiązuje jednak tylko do 200 tysięcy tokenów w zapytaniu, a powyżej progu podwaja się dla całego zapytania. Artificial Analysis wycenia jedno domknięte zadanie na 0,84 dolara przy średnio 53 turach, o połowę krócej niż Claude Opus 5 Max. W tle toczą się trzy postępowania wobec X i SpaceXAI: Ofcomu, brytyjskiego urzędu ochrony danych i Komisji Europejskiej.

Napisała AI, żeby oszczędzić Ci czytania setek źródeł.  ·  Jak to działa

Model / Badania  ·  4 min  · 

Najnowszy Grok wchodzi tam, gdzie firmy już mają fakturę
Ilustrację przygotowała AI.

Grok 4.6 trafił 21 sierpnia do Model Garden na Vertex AI, na razie w wersji zapoznawczej, czyli tam, gdzie zespoły pracujące na Google Cloud wybierają modele, po które sięgają na co dzień. Brzmi jak drobny wpis na liście zmian, a jest najbardziej praktyczną rzeczą, jaka przydarzyła się temu modelowi od premiery. Żeby go dziś wywołać, nie zakładasz konta u SpaceXAI ani nie przepychasz umowy z nowym dostawcą przez dział zakupów, tylko dopisujesz kolejną pozycję do rachunku, który firma i tak płaci Google'owi.

Sam wynik na testach przestał być w tej historii argumentem. Na FrontierCode, teście sprawdzającym, jak model radzi sobie z zadaniami programistycznymi, Groka 4.6 dzieli od GPT-5.6 Sol Max siedem dziesiątych punktu. Kiedy czołowe modele mieszczą się w takim rozrzucie, o wyborze decyduje już nie tabelka, tylko to, gdzie model wolno uruchomić, ile naprawdę kosztuje i od kogo się go kupuje.

Stawka 2 dolarów kończy się przy 200 tysiącach tokenów

Czytaj dalej za darmo

Podaj e-mail, aby odblokować pełną treść i cały serwis. Zapiszemy Cię do newslettera.

Powiązane

Grok 4.7 kosztuje tyle samo za token, ale na zadanie zużywa dwa razy więcej Model / Badania

Grok 4.7 kosztuje tyle samo za token, ale na zadanie zużywa dwa razy więcej

4 min

xAI wypuściło 21 września Groka 4.7 w tej samej cenie co poprzednik, czyli 2 dolary za milion tokenów wejściowych i 6 za milion wyjściowych, ale na najwyższym poziomie rozumowania model zużywa średnio około 81 tysięcy tokenów na zadanie, a Grok 4.6 potrzebował 36 tysięcy. Nowa wersja rzadziej zmyśla i zajmuje czwarte miejsce w rankingu agentów programistycznych Artificial Analysis, choć w Terminal-Bench 4.0 wciąż traci prawie 20 punktów do Fable 5.1. Zanim ustawisz najwyższy poziom na stałe, zmierz na własnych zadaniach, ile tokenów trafi na fakturę.

2,49 dolara za zadanie: nowy model SpaceXAI uderza w koszt agentów Model / Badania

2,49 dolara za zadanie: nowy model SpaceXAI uderza w koszt agentów

4 min

SpaceXAI wypuściło Grok 4.5, swój pierwszy model zbudowany pod programowanie i pracę agentów, i celuje w rachunek: według Artificial Analysis jedno zadanie kosztuje na nim około 2,49 dolara, prawie pięć razy mniej niż 11,80 dolara na Fable 5 od Anthropica. Oszczędność bierze się z niższej ceny tokenów i mniejszej liczby kroków, a model trenowano razem z Cursorem, na danych o tym, jak programiści naprawdę piszą kod. Haczyk jest realny: tani token nie znaczy tani efekt, bo Grok 4.5 pewniej brnie w błąd, gdy się myli, a do połowy lipca w ogóle nie działa w Unii Europejskiej.

Który model taniej dowozi agenta? Nie ten z tańszym tokenem Model / Badania

Który model taniej dowozi agenta? Nie ten z tańszym tokenem

4 min

Dwunastego sierpnia DeepSeek wypuścił V4 Pro, a SpaceXAI Groka 4.6, oba pod pracę agentową, i branża odczytała to jako kolejną wojnę cenową. Ale w teście Composio na 30 trudnych zadaniach Grok zaliczył 23, DeepSeek 18, i przesądza tu nie cennik, tylko koszt jednego udanego zadania: Grok kończył za 0,48 dolara, DeepSeek za 0,60, bo więcej prób wyrzucał do kosza. Wniosek dla kogoś, kto wybiera model pod agenta, jest prosty: liczy się nie cena za milion tokenów, tylko koszt zadania, które naprawdę się udało.