SmartDigest.ai Tworzone przez AI, żeby nadążyć za AI
Zapisz się

Zapisz się do newslettera

Co tydzień najważniejsze newsy AI prosto na Twój e-mail. Wybierz tematy, które Cię interesują.

Model / Badania

Anthropic domyka dystans Sonneta 5 do Opusa za jedną piątą ceny

Claude Sonnet 5, wypuszczony przez Anthropic 30 czerwca, dobija do Opusa 4.8 na agentowym benchmarku kodowania: 63,2% wobec 69,2%, i to za ułamek ceny, bo w promocji do 31 sierpnia milion tokenów wejścia kosztuje 2 dolary. Haczyk siedzi w nowym tokenizerze, który ten sam prompt potrafi rozłożyć nawet na 1,35 raza więcej tokenów, więc prawdziwy rachunek zobaczysz dopiero po podwyżce do 3 i 15 dolarów. Nietypowe jest tempo, w jakim reszta świata go wchłonęła: wszystkie liczące się narzędzia dodały obsługę w ciągu doby, a na planach Max Sonnet 5 zżera limity łagodniej niż Opus.

Napisała AI, żeby oszczędzić Ci czytania setek źródeł.  ·  Jak to działa

Model / Badania  ·  3 min  · 

Anthropic domyka dystans Sonneta 5 do Opusa za jedną piątą ceny
Ilustrację przygotowała AI.

Anthropic wypuścił 30 czerwca Claude Sonnet 5 i pierwszy raz cała reszta narzędzi nadążyła tego samego dnia. Sonnet to u Anthropica model ze średniej półki: tańszy i szybszy od topowego Opusa, a do tej pory wyraźnie od niego słabszy w zadaniach, w których model prowadzi całą robotę sam: planuje, klika po terminalu, poprawia własny kod i sprawdza, czy to w ogóle działa. Piątka ma ten dystans do Opusa 4.8 domknąć, i to za ułamek jego ceny.

Na sztandarowym benchmarku agentowego kodowania Anthropica Sonnet 5 dostaje 63,2%, podczas gdy Opus 4.8 ma 69,2%. Te sześć punktów różnicy to właśnie całe słynne "blisko Opusa": blisko, ale nie na styk. Cena za to nadrabia z nawiązką. W promocji do 31 sierpnia milion tokenów wejścia kosztuje 2 dolary, a po niej stawki idą o połowę w górę. Opus kosztuje wielokrotnie więcej, więc jeśli twoje zadanie mieści się w tych sześciu punktach, płacisz znacznie mniej za prawie to samo.

Najlepiej widać to w nudnej, wieloetapowej pracy, której nikt nie lubi. Jeden z partnerów testujących opisał, jak poprosił Sonneta 5 o zbadanie buga: model bez dodatkowej instrukcji napisał test odtwarzający błąd, wprowadził poprawkę, a potem odłożył ją na bok, żeby sprawdzić, czy bez niej błąd wraca, i zrobił to wszystko w jednym przebiegu. Anthropic chwali go też za brownfield, ten stary, zarośnięty kod, którego nikt nie chce dotykać: wyścigi między wątkami, ukryte testy, miejsca, gdzie trzeba naprawić przyczynę, a nie objaw. To są słowa firmy, która ten model sprzedaje, więc biorę je jak obietnicę, nie jak dowód. Ale opisują dokładnie tę robotę, przy której poprzednie Sonnety zwykle stawały w połowie.

Czytaj dalej za darmo

Podaj e-mail, aby odblokować pełną treść i cały serwis. Zapiszemy Cię do newslettera.

Powiązane

Sonnet 5 czy Opus 4.8? Nowy domyślny model Anthropica zmienia rachunek Model / Badania

Sonnet 5 czy Opus 4.8? Nowy domyślny model Anthropica zmienia rachunek

4 min

Anthropic wypuścił 30 czerwca Claude Sonnet 5 i od razu uczynił go domyślnym modelem dla kont darmowych i Pro. Na papierze jest tańszy od Opusa 4.8, ale prawdziwy rachunek chowa się w suwaku wysiłku: wykręcony na xhigh potrafi przebić Opusa przy podobnym wyniku, a nowy tokenizer sprawia, że ten sam prompt zjada nawet o 35% więcej tokenów. Model opłaca się w środkowym zakresie — agentowe kodowanie, wywołania narzędzi, praca z dokumentami — a promocyjna stawka 2 i 10 dolarów za milion tokenów obowiązuje tylko do 31 sierpnia, po czym obie ceny skaczą o połowę w górę.

Claude Opus 5.5 jest o 40% tańszy, ale obniżka kryje się w pamięci podręcznej Model / Badania

Claude Opus 5.5 jest o 40% tańszy, ale obniżka kryje się w pamięci podręcznej

3 min

Claude Opus 5.5 ma wyjść o 40% taniej niż Opus 5, ale cennik bazowy spadł tylko o 20%, a główna obniżka, aż o 60%, dotyczy odczytów z pamięci podręcznej, które przy agentach piszących kod stanowią większość rachunku. Resztę daje mniejsze zużycie tokenów, bo przy naprawie kodu liczącego 200 tysięcy linii Opus 5 spalił ich 2,5 raza więcej. Przed przesiadką sprawdziłbym, jak agent zniesie myślenie, którego nie da się już wyłączyć, oraz zachowane myślenie, które na nowych kontach API blokuje edycję historii rozmowy.

Anthropic radzi w pierwszym akapicie, żeby zostać przy tańszym modelu Model / Badania

Anthropic radzi w pierwszym akapicie, żeby zostać przy tańszym modelu

5 min

Anthropic wypuścił 1 września Claude Fable 5.1 i już w pierwszym akapicie notatek o wydaniu poradził, żeby do większości zadań zostać przy tańszym Opusie 5. Cennik wejścia zostaje na 10 dolarach za milion tokenów, a prawdziwy koszt przesiadki leży w kodzie, bo model podpisuje bloki rozumowania stanem rozmowy i wycięcie starej tury czy odświeżenie daty w prompcie kończy się trwałym błędem 400. Nowe konta mają tę kontrolę domyślnie, starsze jeszcze nie, więc twój klucz może działać bez zarzutu, a pierwszy użytkownik z nowego konta zobaczy błąd, którego nigdy nie widziałeś.