SmartDigest Tworzone przez AI, żeby nadążyć za AI
Zapisz się

Zapisz się do newslettera

Co tydzień najważniejsze newsy AI prosto na Twój e-mail. Wybierz tematy, które Cię interesują.

Premiera / Narzędzie

LoopX pilnuje celu i dowodów, kiedy agent zapomina, co robił trzy tury wcześniej

LoopX, świeży projekt open-source na licencji MIT autorstwa huangruitenga, dokłada do agenta osobną warstwę sterującą z trwałym zapisem stanu: cel, zadania, miejsca wymagające decyzji człowieka, zebrane dowody i limit decydujący, czy pętla może biec dalej. Agent, czy to Codex, Claude Code czy Cursor, dostaje jedną ograniczoną turę i oddaje sterowanie z powrotem, dzięki czemu wielodniowa praca daje się przejrzeć, wznowić i bezpiecznie przekazać między agentami. Autor pokazuje dwie ścieżki po ponad 200 godzin zegarowych, ale obie prowadził sam, więc brakuje dowodu, że działa u kogoś z zewnątrz.

Napisała AI, żeby oszczędzić Ci czytania setek źródeł.  ·  Jak to działa

Premiera / Narzędzie  ·  4 min  · 

LoopX pilnuje celu i dowodów, kiedy agent zapomina, co robił trzy tury wcześniej
Ilustrację przygotowała AI.

Agent radzi sobie z zadaniem, które mieści się w jednej sesji: przeczytać zgłoszenie, napisać poprawkę, otworzyć pull requesta. Problem zaczyna się wtedy, gdy praca ciągnie się przez wiele dni. Cel się zmienia, właściciel projektu podejmuje decyzje, które trzeba gdzieś zapisać, wcześniejsze ustalenia się dezaktualizują, a jeden agent przekazuje robotę drugiemu. Historia czatu i zwykły licznik czasu tego nie udźwigną. Model po prostu zapomina, co było trzy tury wcześniej, i rusza dalej, jakby nic się nie stało.

LoopX, świeży projekt open-source na licencji MIT, próbuje ten problem rozwiązać od strony, którą jego autor nazywa lokalną warstwą sterującą (control plane). Zamiast pisać kolejnego agenta, LoopX trzyma obok agenta osobny, trwały zapis tego, co się dzieje: jaki jest cel, co jest do zrobienia, gdzie potrzebna jest decyzja człowieka, jakie ślady zostawiła dotychczasowa praca i czy pętla w ogóle może działać dalej. Sam agent, czy to Codex, Claude Code, Cursor, czy twój własny skrypt, dostaje do wykonania jedną ograniczoną turę, a potem oddaje sterowanie z powrotem do tego zapisu. LoopX celowo nie zastępuje środowiska, w którym agent działa. I to jest, moim zdaniem, dobry instynkt: nie próbować budować sprytniejszego agenta, tylko dać temu, który już pracuje, trwałą pamięć i hamulec.

Najprościej wyobrazić to sobie jako tablicę Kanban dla pracy, która nie kończy się w jedno popołudnie. Każda karta niesie ze sobą swoją tożsamość, uprawnienia, zebrane dowody i informację o tym, co ma się stać dalej. Ruchy na tablicy to nie dowolne przeciągnięcia, tylko sprawdzone operacje: zajmij zadanie, postaw bramkę tam, gdzie potrzebna jest zgoda człowieka, obserwuj, dopisz wynik. Sama tablica jest tylko widokiem, a prawdziwym źródłem prawdy pozostaje zapis stanu pod spodem.

Czytaj dalej za darmo

Podaj e-mail, aby odblokować pełną treść i cały serwis. Zapiszemy Cię do newslettera.

Powiązane

Dwa zdania w kodzie Codexa: pracuj bez końca, ale nie ruszaj niczego na zewnątrz Premiera / Narzędzie

Dwa zdania w kodzie Codexa: pracuj bez końca, ale nie ruszaj niczego na zewnątrz

4 min

W publicznym repozytorium Codexa, agenta OpenAI do pisania kodu, WIRED znalazł 27 sierpnia ustawienie Persistent, które wyłącza stoper i pozwala pracować, dopóki użytkownik sam nie uśpi agenta. Obok leży druga instrukcja, proactivity, dzięki której agent sam dopisuje sobie zadania, wraca do nich w kolejnych sesjach i odzywa się bez pytania. OpenAI potwierdza testy i zapewnia, że premiery nie planuje, a oba hamulce, brak nowych uprawnień i oszczędne pisanie do użytkownika, są na razie zdaniami w pliku, nie twardą granicą systemu, a tryb ciągły kosztuje najwięcej wtedy, gdy pracuje najdłużej.

Twoja wiadomość nie budzi tego agenta, bo on nie spał Premiera / Narzędzie

Twoja wiadomość nie budzi tego agenta, bo on nie spał

4 min

Headlong, otwarty harness Laude Institute na licencji Apache 2.0, odwraca zwykły układ: agent nie czeka na polecenie, tylko myśli bez przerwy, a twoja wiadomość wpada do jego strumienia jako kolejna obserwacja. Całość to jakieś 10 tysięcy linii Basha, w których model odpisuje poleceniem powłoki zamiast wywołaniem narzędzia, a agent forkuje własny kod, żeby siebie poprawiać, i wysłał już do głównej gałęzi ponad 50 commitów. Samo trwanie kosztuje od 1 do 2 dolarów za godzinę, ponad 700 dolarów miesięcznie w pełnym tempie, więc ciągłe myślenie ma licznik.

Anthropic chce, żeby Claude Code działał, kiedy nikogo nie ma przy klawiaturze Premiera / Narzędzie

Anthropic chce, żeby Claude Code działał, kiedy nikogo nie ma przy klawiaturze

4 min

Anthropic wypuścił scenariusze (routines) w Claude Code: zapakowany prompt, repo i konektory uruchamiane z harmonogramu, webhookiem z GitHuba albo wywołaniem HTTP, bez otwartego terminala. Limity to pięć uruchomień dziennie na Pro, 15 na Max, 25 na Team i Enterprise. Równolegle przeprojektowali desktop pod równoległe sesje, a w Opus 4.7 domyślny wysiłek to nowy poziom xhigh, model sam decyduje o długości myślenia i rzadziej rozsyła podagentów. Razem te trzy ruchy przesuwają Claude Code z asystenta w edytorze w stronę pracy bez nadzoru.