SmartDigest.ai Tworzone przez AI, żeby nadążyć za AI
Zapisz się

Zapisz się do newslettera

Co tydzień najważniejsze newsy AI prosto na Twój e-mail. Wybierz tematy, które Cię interesują.

Model / Badania

Cena powrotu Fable 5: więcej fałszywych alarmów przy zwykłym kodzie

Od 1 lipca Claude Fable 5 znów działa na całym świecie, po 19 dniach przerwy, ale wrócił z ostrzejszym filtrem, który częściej blokuje zwykłe pisanie i szukanie błędów w kodzie i po cichu przełącza je na słabszego Opusa 4.8. Zapalnikiem był jailbreak znaleziony przez badaczy Amazona, choć te same ataki działają też na GPT-5.5 czy Kimi K2.7. Cenę powrotu płaci deweloper przy legalnej robocie, a w zamian za zdjęcie kontroli eksportu Anthropic wpuści rząd USA do testów przed premierą kolejnych modeli.

Napisała AI, żeby oszczędzić Ci czytania setek źródeł.  ·  Jak to działa

Model / Badania  ·  4 min  · 

Cena powrotu Fable 5: więcej fałszywych alarmów przy zwykłym kodzie
Ilustrację przygotowała AI.

Od 1 lipca Claude Fable 5, najmocniejszy publicznie dostępny model Anthropic, znów działa na całym świecie: w Claude.ai, na platformie Claude, w Claude Code i Claude Cowork. Wrócił po 19 dniach ciszy, tyle że wrócił z filtrem, który częściej niż wcześniej wchodzi w drogę zwykłej pracy przy kodzie.

Cofnijmy się do 9 czerwca, bo bez tego "wrócił" nie ma punktu odniesienia. Anthropic wypuścił wtedy Fable 5 razem z Mythos 5, czyli tym samym modelem pod spodem, tyle że Fable dostał najmocniejsze zabezpieczenia, jakie firma kiedykolwiek nałożyła, a Mythos dostał ich znacznie mniej i trafił tylko do wąskiej grupy firm w zamkniętym programie testowym o nazwie Project Glasswing. Pisałem o tej premierze, gdy najmocniejszą wersję Anthropic zatrzymał dla garstki firm, a publiczna po cichu przełączała pytania o cyberbezpieczeństwo na słabszy Opus 4.8. Ten sam mechanizm wraca teraz w ostrzejszej formie.

Zapalnik, który działał na każdym modelu

Czytaj dalej za darmo

Podaj e-mail, aby odblokować pełną treść i cały serwis. Zapiszemy Cię do newslettera.

Powiązane

Anthropic wypuścił Fable 5, a najmocniejszą wersję znów zatrzymał dla ośmiu firm Model / Badania

Anthropic wypuścił Fable 5, a najmocniejszą wersję znów zatrzymał dla ośmiu firm

5 min

9 czerwca Anthropic udostępnił Claude Fable 5, swój najmocniejszy publicznie dostępny model, który wskoczył na pierwsze miejsce SWE-bench Pro z wynikiem 80,3%, o 11,1 punktu wyżej niż Opus 4.8, choć liczby pochodzą wyłącznie od producenta. Model kosztuje dwa razy tyle i sam decyduje, ile czasu poświęcić na myślenie, bez możliwości wyłączenia. Tego samego dnia pojawił się Mythos 5, ten sam zestaw wag bez filtra bezpieczeństwa, dostępny tylko dla wąskiej grupy klientów w Project Glasswing, podczas gdy wersja publiczna po cichu przełącza pytania o cyberbezpieczeństwo na słabszy Opus 4.8.

Fable 5.1 tanieje tylko w jednej pozycji rachunku Model / Badania

Fable 5.1 tanieje tylko w jednej pozycji rachunku

5 min

Fable 5.1 kosztuje dokładnie tyle co poprzednik, 10 dolarów za milion tokenów wejścia i 50 za milion wyjścia, a obiecane 25% taniej bierze się z jednej pozycji rachunku: odczyt z pamięci podręcznej staniał o 75%, do 0,25 dolara, więc zyskuje głównie ten, kto przepycha przez API ogromny i powtarzalny kontekst. Największy skok widać na Terminal-Bench 4.0, gdzie wynik urósł o blisko 14 punktów, a filtr bezpieczeństwa odzywa się o około 60% rzadziej. Przy przesiadce warto sprawdzić kod, bo tool_choice z wartością any lub tool zwraca teraz błąd 400.

Anthropic radzi w pierwszym akapicie, żeby zostać przy tańszym modelu Model / Badania

Anthropic radzi w pierwszym akapicie, żeby zostać przy tańszym modelu

5 min

Anthropic wypuścił 1 września Claude Fable 5.1 i już w pierwszym akapicie notatek o wydaniu poradził, żeby do większości zadań zostać przy tańszym Opusie 5. Cennik wejścia zostaje na 10 dolarach za milion tokenów, a prawdziwy koszt przesiadki leży w kodzie, bo model podpisuje bloki rozumowania stanem rozmowy i wycięcie starej tury czy odświeżenie daty w prompcie kończy się trwałym błędem 400. Nowe konta mają tę kontrolę domyślnie, starsze jeszcze nie, więc twój klucz może działać bez zarzutu, a pierwszy użytkownik z nowego konta zobaczy błąd, którego nigdy nie widziałeś.