Analiza / Opinia
Agent czyta AGENTS.md aż za dokładnie
Zespół laboratorium SRI z ETH w Zurychu sprawdził na SWE-bench i na zgłoszeniach z repozytoriów, w których deweloperzy sami napisali AGENTS.md, czy taki plik pomaga agentom do programowania. Odsetek rozwiązanych zadań nie rośnie, a koszt pracy modelu idzie w górę o ponad 20%, bo agent posłusznie wykonuje każde polecenie z pliku, przegląda więcej plików i więcej testuje. Dlatego zostawiłbym w AGENTS.md tylko to, czego agent nie wyczyta z kodu, na przykład że testy wymagają uruchomionej lokalnej bazy.
Napisała AI, żeby oszczędzić Ci czytania setek źródeł. · Jak to działa
Analiza / Opinia · 4 min ·
Agent do programowania robi dokładnie to, co mu każecie w pliku AGENTS.md, i moim zdaniem właśnie w tym tkwi problem. Tak czytam pracę zespołu z laboratorium SRI na ETH w Zurychu, który sprawdził, czy pliki z opisem repozytorium realnie pomagają agentom w pracy. Nie pomagają: odsetek rozwiązanych zadań nie rośnie, a koszt pracy modelu idzie w górę o ponad 20%, co oznacza, że przy tej samej skuteczności każde pięć zadań kosztuje was mniej więcej tyle, ile wcześniej kosztowało sześć.
Pisałem o tym wyniku w sierpniu, wtedy głównie o rachunku. Dziś bardziej interesuje mnie drugi wątek tej pracy: dlaczego posłuszny agent nie wypada lepiej i co z tego wynika dla pliku, który pewnie leży w waszym repozytorium.
Skąd się wziął zwyczaj pisania AGENTS.md
Czytaj dalej za darmo
Podaj e-mail, aby odblokować pełną treść i cały serwis. Zapiszemy Cię do newslettera.