SmartDigest Tworzone przez AI, żeby nadążyć za AI
Zapisz się

Zapisz się do newslettera

Co tydzień najważniejsze newsy AI prosto na Twój e-mail. Wybierz tematy, które Cię interesują.

Premiera / Narzędzie

14 razy szybszy Sol brzmi świetnie, tylko ile kosztuje?

OpenAI pokazało Ultrafast, tryb w API, w którym flagowy GPT-5.6 Sol odpowiada do 14 razy szybciej i generuje do 750 tokenów na sekundę, licząc na sprzęcie Cerebras. To ten sam model co zawsze, więc znika stary kompromis między "mądry" a "natychmiastowy", a najbardziej wiarygodny przykład to zaciśnięcie nocnej pętli eksperymentów badawczych do kilku przebiegów dziennie. Nowość jest jednak w wąskim podglądzie dla garstki firm, bez ceny i bez niezależnego potwierdzenia. Dopóki OpenAI nie poda ceny, "14 razy szybciej" pozostaje liczbą, na której nic jeszcze nie da się policzyć.

Napisała AI, żeby oszczędzić Ci czytania setek źródeł.  ·  Jak to działa

Premiera / Narzędzie  ·  3 min  · 

14 razy szybszy Sol brzmi świetnie, tylko ile kosztuje?
Ilustrację przygotowała AI.

OpenAI pokazało Ultrafast, nowy poziom usługi w swoim API, na którym flagowy model GPT-5.6 Sol odpowiada do 14 razy szybciej niż w trybie standardowym i generuje do 750 tokenów na sekundę. Mówiąc wprost: ten sam model, którego zwykle bierze się do najtrudniejszych rzeczy, ma tu pisać szybciej, niż zdążysz to przeczytać. Tyle że cała nowość jest na razie dostępna wyłącznie w wąskim podglądzie dla garstki wybranych firm, bez podanej ceny i bez jednego niezależnego pomiaru, który potwierdziłby te liczby. Prawdziwe pytanie nie brzmi więc "jak szybko", tylko "ile to kosztuje", a akurat tej liczby OpenAI nie podało.

Do tej pory prędkość kosztowała inteligencję

Jeśli potrzebowałeś odpowiedzi w czasie rzeczywistym, do niedawna brałeś model mniejszy albo wyspecjalizowany, z założenia słabszy od flagowca. Ultrafast ma ten kompromis znieść: to ten sam Sol co zawsze, tylko liczony na sprzęcie Cerebras, firmy, która robi wielkie układy scalone zaprojektowane pod jedno zadanie: żeby model generował tekst możliwie najszybciej. OpenAI opisuje to jako więcej użytecznej pracy na sekundę i pod tym hasłem faktycznie kryje się realna zmiana: przestajesz wybierać między "mądry" a "natychmiastowy". Dopóki działa to tylko w demie, brzmi jak marketing, ale kierunek jest prawdziwy. Przez ostatnie lata prędkość i inteligencja ciągnęły w przeciwne strony, a każdy, kto budował coś, co musi odpowiadać od razu, schodził na słabszy model i się z tym godził.

Czytaj dalej za darmo

Podaj e-mail, aby odblokować pełną treść i cały serwis. Zapiszemy Cię do newslettera.

Powiązane

Tanie półki GPT-5.6 zmieniają rachunek bardziej niż flagowy Sol Model / Badania

Tanie półki GPT-5.6 zmieniają rachunek bardziej niż flagowy Sol

4 min

OpenAI wypuściło 9 lipca rodzinę GPT-5.6: flagowego Sola, tańszą Terrę i najtańszą Lunę, a najważniejsza liczba to nie "mądrzejszy", tylko "tańszy". Sol wypada o punkt poniżej Fable 5 na indeksie inteligencji, kończy jednak zadania w 61% krótszym czasie i za mniej więcej połowę kosztu, choć na SWE-Bench Pro zbiera tylko 64,6% wobec 80% konkurenta. Prawdziwą różnicę w rachunku robią dwie tanie półki: Terra i Luna biją Fable 5 przy około jednej szesnastej kosztu, a Luna startuje od 1 dolara za milion tokenów na wejściu. To nie przewrót, tylko przesunięcie stołu w stronę taniej.

GPT-6 Sol i Luna: OpenAI tnie ceny o połowę, ale liczyć trzeba koszt zadania Model / Badania

GPT-6 Sol i Luna: OpenAI tnie ceny o połowę, ale liczyć trzeba koszt zadania

4 min

OpenAI wypuściło 22 września modele GPT-6 Sol i Luna o połowę tańsze od poprzedników, ale przy agencie programistycznym liczy się koszt całego zadania, a nie cena tokenu. Sol zdobywa 68,8% na DeepSWE, teście agentów naprawiających prawdziwe repozytoria, czyli niewiele mniej niż Claude Fable 5 przy rachunku niższym o około 80%. Niezależne pomiary studzą jednak entuzjazm, bo Artificial Analysis daje Solowi 48 punktów wobec 58 dla Claude Opus 5.5, a tańszy DeepSeek V4.1 Flash wyprzedza Lunę w programowaniu.

Tanie modele OpenAI po przecenie: Luna 13,8 raza w górę, Sol w miejscu Model / Badania

Tanie modele OpenAI po przecenie: Luna 13,8 raza w górę, Sol w miejscu

4 min

Po obniżce ceny Luny o 80%, do 20 centów za milion tokenów na wejściu, jej dzienne zużycie na OpenRouterze urosło 13,8 raza, podczas gdy nietknięty cenowo Sol stał w miejscu z wynikiem 1,1 raza. Około trzech czwartych tego przyrostu odebrano konkurencyjnym dostawcom, a udział tanich modeli OpenAI skoczył z 0,7% do 7,8% ruchu platformy. Skok przypisano potem Solowi, chociaż zmierzono go na Lunie trzy tygodnie wcześniej, a tańszy token i tak nie oznacza tańszego zadania, bo każde kolejne podejście modelu to osobny rachunek.