Premiera / Narzędzie
Claude Code od 14 sierpnia sam zatwierdza większość swoich komend
Od 14 sierpnia Claude Code na planach Pro, Max i Team domyślnie rusza w trybie auto: zamiast pytać o zgodę przy każdej komendzie, przepuszcza akcje przez klasyfikator, który blokuje tylko to, co niszczące albo wynoszące dane na zewnątrz. W badaniu Anthropic na 1053 testerach człowiek wyłapywał podłożoną groźną komendę w 13,6% przypadków, a tryb auto w 89%. Klasyfikator pilnuje jednak bezpieczeństwa, nie poprawności kodu: cichej, kompilującej się, ale błędnej zmiany nie złapie, więc nadzór przesuwa się do przeglądu PR-ów, których zespoły na trybie auto wystawiają około 25% więcej.
Napisała AI, żeby oszczędzić Ci czytania setek źródeł. · Jak to działa
Premiera / Narzędzie · 4 min ·
Od 14 sierpnia Claude Code przestaje pytać o zgodę na każdą komendę. Na planach Pro, Max i Team nowe sesje ruszają domyślnie w trybie auto, w którym zamiast wyskakującego "czy wykonać?" przy każdym zapisie pliku i każdym poleceniu w terminalu narzędzie przepuszcza kolejne akcje przez klasyfikator, czyli osobny mały model blokujący tylko to, co nieodwracalne, niszczące albo wysyłane poza twoje środowisko. Kto sam ustawił sobie wcześniej inny tryb, może dostać jednorazowe pytanie, czy chce się przełączyć, a reszcie po prostu zmieni się domyślne zachowanie. Do tej pory tryb auto trzeba było włączyć ręcznie. Teraz staje się punktem wyjścia.
Żeby zobaczyć, że to nie jest kosmetyczna zmiana ustawień, wystarczy jedna para liczb. W kontrolowanym badaniu Anthropic wzięło udział 1053 płatnych testerów. Człowiek wyłapywał podłożoną, wyraźnie groźną komendę w 13,6% przypadków, a tryb auto blokował te same komendy w 89%. To samo starcie w liczbach bezwzględnych wygląda tak: klasyfikator zatrzymał 800 poleceń, które ludzie przepuścili, a ludzie tylko sześć, które klasyfikator wpuścił dalej. Na pierwszy rzut oka maszyna pilnuje bezpieczeństwa lepiej niż my.
Ten wynik mówi jednak coś niewygodnego o samych pytaniach o zgodę. Anthropic przyznaje, że przy pojedynczych komendach użytkownicy odrzucają ledwie 3% pytań. Gdy jednak Claude pokazuje im do akceptacji cały plan, a nie pojedynczą komendę, odrzucają już 39%. Pojedyncze pytanie o zgodę dawno przestało być realnym punktem kontrolnym i stało się odruchem.
Czytaj dalej za darmo
Podaj e-mail, aby odblokować pełną treść i cały serwis. Zapiszemy Cię do newslettera.