Analiza / Opinia
Kod da się sprawdzić i na tym stoi cała przewaga agentów
Phillip Isola z MIT tłumaczy w rozmowie dla MIT News, dlaczego z całej fali agentów AI naprawdę wypaliła tylko jedna kategoria: te do pisania kodu. Powód jest prozaiczny, kod da się sprawdzić, więc agent może odpalić własne rozwiązanie, napisać test i kręcić pętlę prób i błędów, aż trafi na dobrą strategię, czego przy rezerwacji lotu czy w medycynie zrobić się nie da. Ta sama łatwość bywa jednak pułapką, bo przy vibe codingu człowiek świadomie rezygnuje z tej weryfikacji, przez co wkradają się błędy i wyciekają prywatne dane.
Napisała AI, żeby oszczędzić Ci czytania setek źródeł. · Jak to działa
Analiza / Opinia · 4 min ·
Agentów AI w ostatnim roku zrobiło się wszędzie pełno. Listopadowy raport MIT Sloan i Boston Consulting Group mówił, że 35% firm już wpuściło je do siebie, a kolejne 44% się do tego szykuje. Ale z całej tej fali tylko jedna kategoria naprawdę działa i akurat ta stoi programiście na biurku: agenty do pisania kodu. Phillip Isola, profesor nadzwyczajny (associate professor) na wydziale EECS i członek laboratorium CSAIL na MIT, który bada, ile właściwie rozumu mają takie systemy, w rozmowie opublikowanej pod koniec czerwca przez MIT News tłumaczy, dlaczego kod poszedł najlepiej ze wszystkiego. Powód jest zaskakująco prozaiczny: kod da się sprawdzić.
Pod maską prawie zawsze pracuje ten sam model
Isola mówi to wprost: "agent" to w dużej mierze nazwa handlowa. Większość firm, które sprzedają agentów, sięga pod spodem po te same kilka modeli i dokłada im dwie rzeczy: możliwość wykonywania akcji i pamięć tego, co się wydarzyło. W środku pracuje zwykły model generatywny, na przykład Claude, a firma owija go warstwą narzędzi dobranych pod konkretne zastosowanie. Dasz mu kalkulator, rozwiąże zadanie z matematyki. Dasz mu dostęp do dysku z historią firmowych negocjacji, będzie się do niej odwoływał.
Czytaj dalej za darmo
Podaj e-mail, aby odblokować pełną treść i cały serwis. Zapiszemy Cię do newslettera.