SmartDigest Tworzone przez AI, żeby nadążyć za AI
Zapisz się

Zapisz się do newslettera

Co tydzień najważniejsze newsy AI prosto na Twój e-mail. Wybierz tematy, które Cię interesują.

Poradnik / Praktyka

Co zmienić we własnych narzędziach do kodu przed przejściem na Opus 5?

Kto podpina Claude Opus 5 pod własne narzędzia do kodu, powinien przejrzeć stare prompty, bo model czyta je dosłownie: recenzent z poleceniem "zgłaszaj tylko poważne błędy" zacznie przemilczać realne problemy, więc lepiej zbierać wszystkie uwagi i odsiewać je osobnym przebiegiem. Poziom effort ustawiony na low lub medium daje według Anthropica dobre wyniki za ułamek tokenów, a wyłączone myślenie potrafi po cichu zamienić wywołanie narzędzia w zwykły tekst. Dlatego myślenie lepiej zostawić włączone i sprawdzać w logach, czy narzędzia naprawdę zadziałały.

Napisała AI, żeby oszczędzić Ci czytania setek źródeł.  ·  Jak to działa

Poradnik / Praktyka  ·  4 min  · 

Co zmienić we własnych narzędziach do kodu przed przejściem na Opus 5?
Ilustrację przygotowała AI.

Jeśli twój automatyczny recenzent pull requestów ma w prompcie zdanie "zgłaszaj tylko poważne błędy", to po przesiadce na Claude Opus 5 może zacząć przemilczać błędy, które warto było zobaczyć. Tak wynika z przewodnika Anthropica o promptowaniu nowego modelu, który przeczytałem z jednym pytaniem: co musi zmienić ktoś, kto podpina Opus 5 pod własne narzędzia do kodu, na przykład pod automatyczny przegląd pull requestów albo pod agenta, który sam dopisuje funkcje. Rad mniej oczywistych niż "usuń prośby o podwójne sprawdzenie" jest tam kilka i układają się w cztery zmiany: inaczej pisany prompt recenzenta, niżej ustawiony poziom namysłu, pełna specyfikacja z wyraźnymi granicami i myślenie, którego lepiej nie wyłączać. Moim zdaniem najwięcej da się wygrać albo stracić na dwóch z nich, czyli na tym, jak mocno każesz modelowi się namyślać, i na tym, czy w ogóle pozwalasz mu myśleć. Zacznę jednak od recenzenta, bo tam stary nawyk szkodzi najszybciej.

Recenzent, który słucha zbyt dosłownie

Wiele promptów do automatycznego przeglądu kodu zawiera zdanie w rodzaju "zgłaszaj tylko poważne błędy" albo "bądź zachowawczy". Przy starszych modelach miało to sens, bo recenzent AI potrafił zasypać pull request uwagami o nazwach zmiennych, a prawdziwy błąd ginął w szumie. Anthropic pisze, że Opus 5 znajduje realne błędy z dużą skutecznością, a jego dodatkowe zgłoszenia to w większości prawdziwe problemy, nie fałszywe alarmy. Stary filtr może więc teraz działać przeciwko tobie: model może potraktować go dosłownie i zgłosić mniej, łącznie z rzeczami, które warto było zobaczyć.

Czytaj dalej za darmo

Podaj e-mail, aby odblokować pełną treść i cały serwis. Zapiszemy Cię do newslettera.

Powiązane

Nowy przewodnik po promptowaniu Opus 5 to lista skreśleń Poradnik / Praktyka

Nowy przewodnik po promptowaniu Opus 5 to lista skreśleń

4 min

Anthropic opublikował osobną stronę o promptowaniu Claude Opus 5, a większość porad sprowadza się do kasowania: prośby o dodatkową weryfikację czy o zachowawczość dziś szkodzą, bo model sprawdza się sam i bierze je dosłownie. Parametr effort steruje tym, ile model myśli, a nie ile pisze, więc o zwięzłość trzeba poprosić wprost. Skłonność do rozsyłania roboty subagentom lepiej przyciąć twardymi limitami ze zmiennych środowiskowych, działającymi od Claude Code 2.1.217, niż prośbą w prompcie. Dokumentacja nie podaje przy tym ani jednej liczby, więc jedyny wiarygodny pomiar zrobisz u siebie.

Opus 5 bierze "bądź zachowawczy" dosłownie i przemilcza część błędów Poradnik / Praktyka

Opus 5 bierze "bądź zachowawczy" dosłownie i przemilcza część błędów

4 min

Anthropic ostrzega w przewodniku po promptowaniu Opus 5, że dopisane kiedyś do promptu "bądź zachowawczy" nowy model bierze dosłownie i razem z hałasem przemilcza część prawdziwych błędów. Parametr effort tnie czas myślenia, ale nie długość odpowiedzi, więc o zwięzłość trzeba poprosić wprost. Przy wyłączonym myśleniu model potrafi napisać coś, co wygląda na wywołanie narzędzia, choć nic się nie uruchomiło, a taki zapis zostaje w historii rozmowy i kolejne tury czytają go jak fakt. Bezpieczniej zostawić myślenie włączone i ciąć koszt niższym ustawieniem effort.

Anthropic każe wyciąć z promptów to, co kiedyś wymuszało dokładność Poradnik / Praktyka

Anthropic każe wyciąć z promptów to, co kiedyś wymuszało dokładność

4 min

Anthropic odświeżył firmowy przewodnik po promptowaniu i większość pracy przy przenoszeniu starych promptów polega teraz na wycinaniu, nie dopisywaniu. Kategoryczne "KRYTYCZNE: MUSISZ" i pisanie wielkimi literami w najnowszych modelach, od Fable 5 po Opus 4.8, zaczynają szkodzić, bo model bierze je zbyt dosłownie. Prefill na końcu rozmowy i parametr budget_tokens zwracają już twardy błąd 400 na Opus 4.7 i nowszych, więc głębokością namysłu steruje się teraz parametrem effort. Przy długich zadaniach rada jest prosta: stan trzymaj poza kontekstem, na dysku, w plikach i w gicie.