SmartDigest.ai Tworzone przez AI, żeby nadążyć za AI
Zapisz się

Zapisz się do newslettera

Co tydzień najważniejsze newsy AI prosto na Twój e-mail. Wybierz tematy, które Cię interesują.

Model / Badania

Sonnet 5.5 kosztuje połowę Opusa, dopóki nie każesz mu długo myśleć

Claude Sonnet 5.5 z 28 września kosztuje za token połowę tego, co Opus 5.5, a w CursorBench traci do niego nieco ponad dwa punkty. Ta przewaga trzyma się jednak tylko na niskim i średnim wysiłku, bo na wyższych poziomach sam Anthropic przyznaje, że Sonnet dogania Opusa przy podobnym koszcie zadania. Najlepiej wypada w prostszych pracach, na przykład w przeglądach kodu, gdzie CodeRabbit zszedł z 1,16 dolara do 47 centów za recenzję. Przy przesiadce trzeba też usunąć parametry temperature i top_p, bo inaczej API zwróci błąd 400.

Napisała AI, żeby oszczędzić Ci czytania setek źródeł.  ·  Jak to działa

Model / Badania  ·  5 min  · 

Sonnet 5.5 kosztuje połowę Opusa, dopóki nie każesz mu długo myśleć
Ilustrację przygotowała AI.

Anthropic wypuścił 28 września model Claude Sonnet 5.5, średni model z nowej rodziny 5.5, i od razu postawił go w tabelach obok flagowego Opusa 5.5. Na papierze to zestawienie wygląda jak okazja, bo Sonnet kosztuje za token połowę tego, co Opus, a w wielu testach traci do niego ledwie dwa, trzy punkty. Po lekturze materiałów premierowych mam jednak wrażenie, że ta połowa ceny obowiązuje tylko w jednej części skali. Im dłużej każesz Sonnetowi myśleć nad zadaniem, tym bardziej jego rachunek zbliża się do tego, który zapłaciłbyś za Opusa, i Anthropic sam to przyznaje, tyle że drobnym drukiem.

Co się zmieniło względem Sonneta 5

Sonnet 5, wydany 30 czerwca, był modelem do codziennej roboty: tańszym od Opusa, ale wyraźnie słabszym w długich, samodzielnych zadaniach. Według Anthropica następca generuje odpowiedzi o ponad 30% szybciej, a przy tej samej cenie za token zużywa na jedno zadanie mniej tokenów, więc wychodzi do 30% taniej od poprzednika. Najgłośniejsza liczba pochodzi z Terminal-Bench 4.0, testu, w którym model wykonuje wieloetapowe zadania w wierszu poleceń: Sonnet 5.5 rozwiązał tam 70,6% zadań i wyprzedził nawet Opusa 5.5, podczas gdy Sonnet 5 utknął na 10,3%.

Czytaj dalej za darmo

Podaj e-mail, aby odblokować pełną treść i cały serwis. Zapiszemy Cię do newslettera.

Powiązane

Anthropic domyka dystans Sonneta 5 do Opusa za jedną piątą ceny Model / Badania

Anthropic domyka dystans Sonneta 5 do Opusa za jedną piątą ceny

3 min

Claude Sonnet 5, wypuszczony przez Anthropic 30 czerwca, dobija do Opusa 4.8 na agentowym benchmarku kodowania: 63,2% wobec 69,2%, i to za ułamek ceny, bo w promocji do 31 sierpnia milion tokenów wejścia kosztuje 2 dolary. Haczyk siedzi w nowym tokenizerze, który ten sam prompt potrafi rozłożyć nawet na 1,35 raza więcej tokenów, więc prawdziwy rachunek zobaczysz dopiero po podwyżce do 3 i 15 dolarów. Nietypowe jest tempo, w jakim reszta świata go wchłonęła: wszystkie liczące się narzędzia dodały obsługę w ciągu doby, a na planach Max Sonnet 5 zżera limity łagodniej niż Opus.

Sonnet 5 czy Opus 4.8? Nowy domyślny model Anthropica zmienia rachunek Model / Badania

Sonnet 5 czy Opus 4.8? Nowy domyślny model Anthropica zmienia rachunek

4 min

Anthropic wypuścił 30 czerwca Claude Sonnet 5 i od razu uczynił go domyślnym modelem dla kont darmowych i Pro. Na papierze jest tańszy od Opusa 4.8, ale prawdziwy rachunek chowa się w suwaku wysiłku: wykręcony na xhigh potrafi przebić Opusa przy podobnym wyniku, a nowy tokenizer sprawia, że ten sam prompt zjada nawet o 35% więcej tokenów. Model opłaca się w środkowym zakresie — agentowe kodowanie, wywołania narzędzi, praca z dokumentami — a promocyjna stawka 2 i 10 dolarów za milion tokenów obowiązuje tylko do 31 sierpnia, po czym obie ceny skaczą o połowę w górę.

Opus 5.5 tańszy o 40%? Cennik obiecuje połowę tej sumy Model / Badania

Opus 5.5 tańszy o 40%? Cennik obiecuje połowę tej sumy

4 min

Anthropic wypuścił 22 września Opusa 5.5 z obietnicą, że kosztuje o 40% mniej niż Opus 5, choć sam cennik daje tylko 20%: milion tokenów wejściowych kosztuje 4 dolary zamiast 5. Resztę oszczędności wyznacza ustawienie wysiłku, którego domyślny poziom spadł z high na medium, więc rachunek zależy od konfiguracji, a nie od samego modelu. Przy migracji wymuszone wywołanie narzędzia kończy się błędem 400, a przy dobrze opisanych zadaniach programistycznych zacząłbym od dwa razy tańszego Sonneta 5.5.