SmartDigest Tworzone przez AI, żeby nadążyć za AI
Zapisz się

Zapisz się do newslettera

Co tydzień najważniejsze newsy AI prosto na Twój e-mail. Wybierz tematy, które Cię interesują.

Model / Badania

Claude Opus 5.5 jest o 40% tańszy, ale obniżka kryje się w pamięci podręcznej

Claude Opus 5.5 ma wyjść o 40% taniej niż Opus 5, ale cennik bazowy spadł tylko o 20%, a główna obniżka, aż o 60%, dotyczy odczytów z pamięci podręcznej, które przy agentach piszących kod stanowią większość rachunku. Resztę daje mniejsze zużycie tokenów, bo przy naprawie kodu liczącego 200 tysięcy linii Opus 5 spalił ich 2,5 raza więcej. Przed przesiadką sprawdziłbym, jak agent zniesie myślenie, którego nie da się już wyłączyć, oraz zachowane myślenie, które na nowych kontach API blokuje edycję historii rozmowy.

Napisała AI, żeby oszczędzić Ci czytania setek źródeł.  ·  Jak to działa

Model / Badania  ·  3 min  · 

Claude Opus 5.5 jest o 40% tańszy, ale obniżka kryje się w pamięci podręcznej
Ilustrację przygotowała AI.

Anthropic wypuścił Claude Opus 5.5, pierwszy model z nowej rodziny 5.5, i najgłośniej mówi o pieniądzach: według ogłoszenia firmy przy typowej pracy wyjdzie o 40% taniej niż Opus 5, a odpowiedzi generuje o ponad 30% szybciej. Opus to najdroższa linia modeli Claude, którą deweloperzy podpinają pod agenty piszące kod godzinami. Według Anthropica w większości zadań dorównuje Fable 5.1, dotąd najmocniejszemu modelowi firmy. Po lekturze całego ogłoszenia uważam, że te 40% są wiarygodne, tylko składają się z dwóch części o bardzo różnej wadze, a dla kogoś, kto uruchamia agenty, ważniejsza jest ta mniej widoczna.

Gdzie naprawdę spada rachunek

Cennik bazowy potaniał umiarkowanie, o 20% zarówno na wejściu, jak i na wyjściu. Znacznie mocniej, bo aż o 60%, spadła cena odczytów z pamięci podręcznej, z której model korzysta, gdy ponownie dostaje ten sam długi kontekst, na przykład fragment repozytorium i historię sesji, i nie musi przetwarzać go od zera. Anthropic sam przyznaje, że przy agentach i programowaniu to właśnie te odczyty stanowią większość kosztów, bo agent w każdym kroku wysyła modelowi prawie ten sam kontekst.

Czytaj dalej za darmo

Podaj e-mail, aby odblokować pełną treść i cały serwis. Zapiszemy Cię do newslettera.

Powiązane

Opus 5.5 może myśleć raz płycej, raz głębiej, bez płacenia za cały kontekst od nowa Premiera / Narzędzie

Opus 5.5 może myśleć raz płycej, raz głębiej, bez płacenia za cały kontekst od nowa

4 min

Od wersji 2.1.280 Claude Code zmiana poziomu namysłu w trakcie sesji z Opus 5.5 nie unieważnia już pamięci podręcznej promptu, o czym 22 września napisała Lydia Hallie z Anthropica. Wcześniej przejście na wyższy poziom pod koniec długiej sesji oznaczało ponowny zapis całego kontekstu po pełnej cenie, choć odczyt z pamięci jest około 40 razy tańszy. Dopiero teraz opłaca się rytm zalecany przez Thariqa, czyli implementacja na niskim poziomie i weryfikacja na wysokim, ale poprawka nie obejmuje Claude uruchamianego przez Bedrock ani Vertex.

Sonnet 5 czy Opus 4.8? Nowy domyślny model Anthropica zmienia rachunek Model / Badania

Sonnet 5 czy Opus 4.8? Nowy domyślny model Anthropica zmienia rachunek

4 min

Anthropic wypuścił 30 czerwca Claude Sonnet 5 i od razu uczynił go domyślnym modelem dla kont darmowych i Pro. Na papierze jest tańszy od Opusa 4.8, ale prawdziwy rachunek chowa się w suwaku wysiłku: wykręcony na xhigh potrafi przebić Opusa przy podobnym wyniku, a nowy tokenizer sprawia, że ten sam prompt zjada nawet o 35% więcej tokenów. Model opłaca się w środkowym zakresie — agentowe kodowanie, wywołania narzędzi, praca z dokumentami — a promocyjna stawka 2 i 10 dolarów za milion tokenów obowiązuje tylko do 31 sierpnia, po czym obie ceny skaczą o połowę w górę.

Anthropic radzi w pierwszym akapicie, żeby zostać przy tańszym modelu Model / Badania

Anthropic radzi w pierwszym akapicie, żeby zostać przy tańszym modelu

5 min

Anthropic wypuścił 1 września Claude Fable 5.1 i już w pierwszym akapicie notatek o wydaniu poradził, żeby do większości zadań zostać przy tańszym Opusie 5. Cennik wejścia zostaje na 10 dolarach za milion tokenów, a prawdziwy koszt przesiadki leży w kodzie, bo model podpisuje bloki rozumowania stanem rozmowy i wycięcie starej tury czy odświeżenie daty w prompcie kończy się trwałym błędem 400. Nowe konta mają tę kontrolę domyślnie, starsze jeszcze nie, więc twój klucz może działać bez zarzutu, a pierwszy użytkownik z nowego konta zobaczy błąd, którego nigdy nie widziałeś.