Premiera / Narzędzie
14 razy szybszy Sol brzmi świetnie, tylko ile kosztuje?
OpenAI pokazało Ultrafast, tryb w API, w którym flagowy GPT-5.6 Sol odpowiada do 14 razy szybciej i generuje do 750 tokenów na sekundę, licząc na sprzęcie Cerebras. To ten sam model co zawsze, więc znika stary kompromis między "mądry" a "natychmiastowy", a najbardziej wiarygodny przykład to zaciśnięcie nocnej pętli eksperymentów badawczych do kilku przebiegów dziennie. Nowość jest jednak w wąskim podglądzie dla garstki firm, bez ceny i bez niezależnego potwierdzenia. Dopóki OpenAI nie poda ceny, "14 razy szybciej" pozostaje liczbą, na której nic jeszcze nie da się policzyć.
Napisała AI, żeby oszczędzić Ci czytania setek źródeł. · Jak to działa
Premiera / Narzędzie · 3 min ·
OpenAI pokazało Ultrafast, nowy poziom usługi w swoim API, na którym flagowy model GPT-5.6 Sol odpowiada do 14 razy szybciej niż w trybie standardowym i generuje do 750 tokenów na sekundę. Mówiąc wprost: ten sam model, którego zwykle bierze się do najtrudniejszych rzeczy, ma tu pisać szybciej, niż zdążysz to przeczytać. Tyle że cała nowość jest na razie dostępna wyłącznie w wąskim podglądzie dla garstki wybranych firm, bez podanej ceny i bez jednego niezależnego pomiaru, który potwierdziłby te liczby. Prawdziwe pytanie nie brzmi więc "jak szybko", tylko "ile to kosztuje", a akurat tej liczby OpenAI nie podało.
Do tej pory prędkość kosztowała inteligencję
Jeśli potrzebowałeś odpowiedzi w czasie rzeczywistym, do niedawna brałeś model mniejszy albo wyspecjalizowany, z założenia słabszy od flagowca. Ultrafast ma ten kompromis znieść: to ten sam Sol co zawsze, tylko liczony na sprzęcie Cerebras, firmy, która robi wielkie układy scalone zaprojektowane pod jedno zadanie: żeby model generował tekst możliwie najszybciej. OpenAI opisuje to jako więcej użytecznej pracy na sekundę i pod tym hasłem faktycznie kryje się realna zmiana: przestajesz wybierać między "mądry" a "natychmiastowy". Dopóki działa to tylko w demie, brzmi jak marketing, ale kierunek jest prawdziwy. Przez ostatnie lata prędkość i inteligencja ciągnęły w przeciwne strony, a każdy, kto budował coś, co musi odpowiadać od razu, schodził na słabszy model i się z tym godził.
Czytaj dalej za darmo
Podaj e-mail, aby odblokować pełną treść i cały serwis. Zapiszemy Cię do newslettera.