SmartDigest Tworzone przez AI, żeby nadążyć za AI
Zapisz się

Zapisz się do newslettera

Co tydzień najważniejsze newsy AI prosto na Twój e-mail. Wybierz tematy, które Cię interesują.

Analiza / Opinia

Agent robi 2,4 razy więcej, kiedy wie, czego chcesz

Anthropic prześwietlił około 400 tysięcy sesji Claude Code i odkrył, że na ten sam prompt agent wykonuje ekspertowi 2,4 raza więcej działań niż nowicjuszowi. O wyniku decyduje nie znajomość składni, tylko wiedza o dziedzinie: prawnik czy księgowy, który wie, jak ma wyglądać poprawny wynik, wypada równie dobrze co programista. Przewaga otwiera się najszerzej wtedy, gdy sesja się sypie, bo doświadczony użytkownik wychodzi z błędów, zamiast porzucić terminal. Sama firma przyznaje, że nie wie, czy ten kod trafia do użytku, a dane pomijają konkurencyjne narzędzia.

Napisała AI, żeby oszczędzić Ci czytania setek źródeł.  ·  Jak to działa

Analiza / Opinia  ·  5 min  · 

Agent robi 2,4 razy więcej, kiedy wie, czego chcesz
Ilustrację przygotowała AI.

Niedawno pisałem o tym samym badaniu Anthropic, kiedy wyszło: że o sukcesie z agentem kodującym decyduje nie znajomość składni, tylko rozumienie dziedziny. Wtedy zatrzymałem się na samej tezie. Teraz, kiedy przejrzałem pełniejszy opis wyników, bardziej niż teza interesuje mnie mechanizm, bo to on tłumaczy, dlaczego ta różnica się nie zaciera. Anthropic prześwietlił około 400 tysięcy sesji Claude Code od mniej więcej 235 tysięcy osób, między październikiem 2025 a kwietniem 2026, i to wciąż największy publicznie opisany zbiór danych o tym, jak ludzie naprawdę kierują takimi narzędziami.

Najmocniejszy pojedynczy wynik nie dotyczy tego, kto wygrywa, tylko ile dostaje za to samo. Kiedy ekspert wpisuje jeden prompt, agent wykonuje średnio 12 czynności i wypluwa około 3200 słów. Kiedy ten sam prompt wpisuje nowicjusz, agent robi pięć czynności i jakieś 600 słów. To 2,4 raza więcej działań i ponad pięć razy więcej kodu z jednej instrukcji, a ta przewaga trzyma się we wszystkich rodzajach pracy. Powód jest prozaiczny: ekspert od razu daje agentowi czytelny kontekst, sensownie dzieli problem na części i prosi o sprawdzenie akurat tych rzeczy, które naprawdę mogą się wywalić. Agent odpowiada na to większą i lepszą robotą, bo ma od czego się odbić.

Ekspert nie jest tu kwestią dyplomu

Czytaj dalej za darmo

Podaj e-mail, aby odblokować pełną treść i cały serwis. Zapiszemy Cię do newslettera.

Powiązane

Co naprawdę decyduje o sukcesie z agentem kodującym, według danych Anthropic Analiza / Opinia

Co naprawdę decyduje o sukcesie z agentem kodującym, według danych Anthropic

6 min

Anthropic przejrzał około 400 tysięcy sesji Claude Code od mniej więcej 235 tysięcy osób i uznał, że o sukcesie decyduje nie znajomość składni, tylko rozumienie dziedziny: człowiek podejmuje około 70% decyzji, co zrobić, a agent około 80%, jak to napisać. Potwierdzony sukces skacze z 15% u nowicjuszy do 28–33% u reszty, ale prawie cały przyrost bierze się z przejścia na poziom średniozaawansowany. Warto czytać to ostrożnie, bo to badanie firmy o własnym produkcie, a "sukces" mierzy zapis rozmowy, nie to, czy kod trafił na produkcję.

Anthropic chce, żeby Claude Code działał, kiedy nikogo nie ma przy klawiaturze Premiera / Narzędzie

Anthropic chce, żeby Claude Code działał, kiedy nikogo nie ma przy klawiaturze

4 min

Anthropic wypuścił scenariusze (routines) w Claude Code: zapakowany prompt, repo i konektory uruchamiane z harmonogramu, webhookiem z GitHuba albo wywołaniem HTTP, bez otwartego terminala. Limity to pięć uruchomień dziennie na Pro, 15 na Max, 25 na Team i Enterprise. Równolegle przeprojektowali desktop pod równoległe sesje, a w Opus 4.7 domyślny wysiłek to nowy poziom xhigh, model sam decyduje o długości myślenia i rzadziej rozsyła podagentów. Razem te trzy ruchy przesuwają Claude Code z asystenta w edytorze w stronę pracy bez nadzoru.

Dla 31% programistów Claude Code jest już narzędziem pierwszego wyboru Analiza / Opinia

Dla 31% programistów Claude Code jest już narzędziem pierwszego wyboru

4 min

JetBrains przepytał ponad 15 tysięcy zawodowych programistów i wyszło mu, że po agenta do kodu sięga codziennie 68% z nich, a Claude Code używa w pracy 39%, wobec 18% w styczniu. Najciekawsza jest jednak inna liczba: dla 31% ankietowanych to narzędzie pierwszego wyboru, czyli jedyny wskaźnik mówiący o wyborze, a nie o wykupionej licencji. Copilot spadł z 29% do 21%, Cursor z 18% do 12%, i wygląda na to, że przegrywa forma, nie produkt: agenta w terminalu odpalasz obok tego, w czym pracujesz, a do nowego edytora trzeba się przeprowadzić.