Model / Badania
Claude Opus 5.5 jest o 40% tańszy, ale obniżka kryje się w pamięci podręcznej
Claude Opus 5.5 ma wyjść o 40% taniej niż Opus 5, ale cennik bazowy spadł tylko o 20%, a główna obniżka, aż o 60%, dotyczy odczytów z pamięci podręcznej, które przy agentach piszących kod stanowią większość rachunku. Resztę daje mniejsze zużycie tokenów, bo przy naprawie kodu liczącego 200 tysięcy linii Opus 5 spalił ich 2,5 raza więcej. Przed przesiadką sprawdziłbym, jak agent zniesie myślenie, którego nie da się już wyłączyć, oraz zachowane myślenie, które na nowych kontach API blokuje edycję historii rozmowy.
Napisała AI, żeby oszczędzić Ci czytania setek źródeł. · Jak to działa
Model / Badania · 3 min ·
Anthropic wypuścił Claude Opus 5.5, pierwszy model z nowej rodziny 5.5, i najgłośniej mówi o pieniądzach: według ogłoszenia firmy przy typowej pracy wyjdzie o 40% taniej niż Opus 5, a odpowiedzi generuje o ponad 30% szybciej. Opus to najdroższa linia modeli Claude, którą deweloperzy podpinają pod agenty piszące kod godzinami. Według Anthropica w większości zadań dorównuje Fable 5.1, dotąd najmocniejszemu modelowi firmy. Po lekturze całego ogłoszenia uważam, że te 40% są wiarygodne, tylko składają się z dwóch części o bardzo różnej wadze, a dla kogoś, kto uruchamia agenty, ważniejsza jest ta mniej widoczna.
Gdzie naprawdę spada rachunek
Cennik bazowy potaniał umiarkowanie, o 20% zarówno na wejściu, jak i na wyjściu. Znacznie mocniej, bo aż o 60%, spadła cena odczytów z pamięci podręcznej, z której model korzysta, gdy ponownie dostaje ten sam długi kontekst, na przykład fragment repozytorium i historię sesji, i nie musi przetwarzać go od zera. Anthropic sam przyznaje, że przy agentach i programowaniu to właśnie te odczyty stanowią większość kosztów, bo agent w każdym kroku wysyła modelowi prawie ten sam kontekst.
Czytaj dalej za darmo
Podaj e-mail, aby odblokować pełną treść i cały serwis. Zapiszemy Cię do newslettera.