SmartDigest.ai Tworzone przez AI, żeby nadążyć za AI
Zapisz się

Zapisz się do newslettera

Co tydzień najważniejsze newsy AI prosto na Twój e-mail. Wybierz tematy, które Cię interesują.

Poradnik / Praktyka

Dwa nawyki ze starych promptów, które na Opus 5 psują wynik

Przewodnik Anthropica po promptowaniu Claude Opus 5 zapewnia, że prompty pisane pod Opusa 4.8 działają bez zmian, ale w dwóch miejscach stary nawyk po cichu psuje wynik. Bot recenzujący pull requesty, któremu kazano być zachowawczym, zgłasza mniej także prawdziwych błędów, więc lepiej prosić o wszystkie znaleziska i odsiewać je w osobnym, widocznym kroku. Prośba o wypisanie toku rozumowania może z kolei skończyć się odmową z kategorią reasoning_extraction i wywrócić automat, dlatego zamiast niej lepiej prosić o krótkie podsumowanie wykonanych kroków.

Napisała AI, żeby oszczędzić Ci czytania setek źródeł.  ·  Jak to działa

Poradnik / Praktyka  ·  4 min  · 

Dwa nawyki ze starych promptów, które na Opus 5 psują wynik
Ilustrację przygotowała AI.

We wrześniu pisałem o stronie, na której Anthropic opisał, jak promptować Claude Opus 5, i wtedy najbardziej rzucało się w oczy, że większość porad każe kasować stare instrukcje, bo przepalają tokeny. Wróciłem do tego przewodnika i tym razem czytałem go pod innym kątem: szukałem miejsc, w których stary prompt po cichu pogarsza wynik. Znalazłem dwa i oba dotyczą rzeczy, które wiele zespołów ma w swoich automatach od dawna: bota, który komentuje kod w pull requestach, i prośby, żeby model pokazał, jak doszedł do odpowiedzi. Wszystkie zalecenia, o których piszę dalej, pochodzą z tej jednej strony dokumentacji.

Anthropic zapewnia, że prompty pisane pod poprzedni Opus 4.8 działają dobrze bez zmian także na Opusie 5, nowym flagowym modelu, który najlepiej radzi sobie z długą pracą w roli agenta, kiedy sam czyta pliki, uruchamia narzędzia i poprawia kod przez wiele kroków. W dwóch miejscach to zapewnienie wymaga jednak zastrzeżenia, bo stary prompt dalej działa, tylko daje gorszy wynik albo nie daje żadnego, a stawką nie jest rachunek, tylko jakość pracy.

Recenzent, któremu kazano być ostrożnym, zgłasza mniej

Czytaj dalej za darmo

Podaj e-mail, aby odblokować pełną treść i cały serwis. Zapiszemy Cię do newslettera.

Powiązane

Nowy przewodnik po promptowaniu Opus 5 to lista skreśleń Poradnik / Praktyka

Nowy przewodnik po promptowaniu Opus 5 to lista skreśleń

4 min

Anthropic opublikował osobną stronę o promptowaniu Claude Opus 5, a większość porad sprowadza się do kasowania: prośby o dodatkową weryfikację czy o zachowawczość dziś szkodzą, bo model sprawdza się sam i bierze je dosłownie. Parametr effort steruje tym, ile model myśli, a nie ile pisze, więc o zwięzłość trzeba poprosić wprost. Skłonność do rozsyłania roboty subagentom lepiej przyciąć twardymi limitami ze zmiennych środowiskowych, działającymi od Claude Code 2.1.217, niż prośbą w prompcie. Dokumentacja nie podaje przy tym ani jednej liczby, więc jedyny wiarygodny pomiar zrobisz u siebie.

Anthropic każe wyciąć z promptów to, co kiedyś wymuszało dokładność Poradnik / Praktyka

Anthropic każe wyciąć z promptów to, co kiedyś wymuszało dokładność

4 min

Anthropic odświeżył firmowy przewodnik po promptowaniu i większość pracy przy przenoszeniu starych promptów polega teraz na wycinaniu, nie dopisywaniu. Kategoryczne "KRYTYCZNE: MUSISZ" i pisanie wielkimi literami w najnowszych modelach, od Fable 5 po Opus 4.8, zaczynają szkodzić, bo model bierze je zbyt dosłownie. Prefill na końcu rozmowy i parametr budget_tokens zwracają już twardy błąd 400 na Opus 4.7 i nowszych, więc głębokością namysłu steruje się teraz parametrem effort. Przy długich zadaniach rada jest prosta: stan trzymaj poza kontekstem, na dysku, w plikach i w gicie.

Co zmienić we własnych narzędziach do kodu przed przejściem na Opus 5? Poradnik / Praktyka

Co zmienić we własnych narzędziach do kodu przed przejściem na Opus 5?

4 min

Kto podpina Claude Opus 5 pod własne narzędzia do kodu, powinien przejrzeć stare prompty, bo model czyta je dosłownie: recenzent z poleceniem "zgłaszaj tylko poważne błędy" zacznie przemilczać realne problemy, więc lepiej zbierać wszystkie uwagi i odsiewać je osobnym przebiegiem. Poziom effort ustawiony na low lub medium daje według Anthropica dobre wyniki za ułamek tokenów, a wyłączone myślenie potrafi po cichu zamienić wywołanie narzędzia w zwykły tekst. Dlatego myślenie lepiej zostawić włączone i sprawdzać w logach, czy narzędzia naprawdę zadziałały.