Model / Badania
GPT-6 Sol i Luna: OpenAI tnie ceny o połowę, ale liczyć trzeba koszt zadania
OpenAI wypuściło 22 września modele GPT-6 Sol i Luna o połowę tańsze od poprzedników, ale przy agencie programistycznym liczy się koszt całego zadania, a nie cena tokenu. Sol zdobywa 68,8% na DeepSWE, teście agentów naprawiających prawdziwe repozytoria, czyli niewiele mniej niż Claude Fable 5 przy rachunku niższym o około 80%. Niezależne pomiary studzą jednak entuzjazm, bo Artificial Analysis daje Solowi 48 punktów wobec 58 dla Claude Opus 5.5, a tańszy DeepSeek V4.1 Flash wyprzedza Lunę w programowaniu.
Napisała AI, żeby oszczędzić Ci czytania setek źródeł. · Jak to działa
Model / Badania · 4 min ·
OpenAI wypuściło 22 września dwa tańsze modele z rodziny GPT-6. Sol ma obsługiwać złożone programowanie i pracę agentów, a Luna dużą liczbę prostszych zadań. Nad nimi zostaje flagowa Astra, najmocniejszy i najdroższy model firmy. W API Sol kosztuje teraz 2 dolary za milion tokenów na wejściu i 10 dolarów na wyjściu, a Luna jest od niego dwudziestokrotnie tańsza. Oba cenniki są o połowę niższe od promocyjnych cen poprzedników z serii GPT-5.6. Nagłówki mówią o cenie tokenu, ja patrzę na inną liczbę, bo przy agencie programistycznym płaci się za całe zadanie, a nie za pojedynczy token.
Ile kosztuje zadanie, a nie token
Na DeepSWE v1.1, teście, w którym agent rozwiązuje złożone zadania programistyczne w prawdziwych repozytoriach, Sol ustawiony na maksymalny poziom rozumowania zdobywa 68,8%. To tylko 1,1 punktu procentowego mniej niż najlepszy wynik Claude Fable 5 od Anthropica, a według OpenAI zadanie kosztuje przy tym około 80% mniej niż u Fable 5. Poziom rozumowania to suwak, którym decydujesz, jak długo model się zastanawia przed odpowiedzią: im wyżej, tym lepszy wynik i wyższy rachunek.
Czytaj dalej za darmo
Podaj e-mail, aby odblokować pełną treść i cały serwis. Zapiszemy Cię do newslettera.