SmartDigest Tworzone przez AI, żeby nadążyć za AI
Zapisz się

Zapisz się do newslettera

Co tydzień najważniejsze newsy AI prosto na Twój e-mail. Wybierz tematy, które Cię interesują.

Premiera / Narzędzie

Agent przeszedł pilotaż. Co zrobi, gdy w połowie biegu wygaśnie klucz dostępu?

Diagrid wydał 17 września pięć kryteriów gotowości produkcyjnej dla agentów: wznawianie od miejsca awarii, dostęp, który nie wygasa w połowie biegu, idempotentność, kontrola tego, co oddaje model, i trwały zapis przebiegu. Każde jest pytaniem, na które odpowiada się logami, a nie akapitem w dokumencie projektowym. To klasyczne wzorce systemów rozproszonych, z jedną różnicą: ponowiony krok agenta może wybrać inne narzędzie i inny plan, więc nie jest tą samą operacją. Tyle że Diagrid sprzedaje dokładnie tę warstwę uruchomieniową, a kryteria wyszły komunikatem prasowym bez jednej liczby.

Napisała AI, żeby oszczędzić Ci czytania setek źródeł.  ·  Jak to działa

Premiera / Narzędzie  ·  4 min  · 

Agent przeszedł pilotaż. Co zrobi, gdy w połowie biegu wygaśnie klucz dostępu?
Ilustrację przygotowała AI.

Agent, który na pokazie przechodzi zadanie od początku do końca, udowadnia dokładnie jedną rzecz: że da się je wykonać, kiedy nic po drodze nie pada. Na produkcji pytania są inne. Co się dzieje, gdy trzeci krok z siedmiu wywraca się w połowie, gdy klucz dostępu wygasa w trakcie biegu, gdy to samo zgłoszenie trafia do agenta dwa razy albo gdy model oddaje coś, czego następny krok nie umie przetworzyć? I czy trzy tygodnie później ktokolwiek potrafi pokazać, czego dotknął ten jeden konkretny przebieg?

Pięć takich pytań spisała firma Diagrid i wydała je 17 września jako kryteria gotowości produkcyjnej dla zespołów platformowych, tych ludzi w organizacji, którzy odpowiadają za to, żeby cudzy kod dało się bezpiecznie wystawić i potem utrzymać. Diagrid sprzedaje infrastrukturę dla agentów i współtworzy projekt open-source Dapr, więc ustala kryteria dla rynku, na którym sama sprzedaje.

Za tymi pytaniami stoi pięć własności. Wznawianie od miejsca awarii, żeby jeden zerwany krok nie cofał agenta na start. Dostęp, który nie wygasa w środku biegu, bo inaczej agent staje w pół kroku, i idempotentność, żeby ponowiona próba nie policzyła tej samej roboty drugi raz. Kontrola tego, co oddaje model, zanim trafi do następnego kroku. I trwały zapis przebiegu, z którego trzy tygodnie później odtworzysz, czego agent dotknął i na czyich danych.

Czytaj dalej za darmo

Podaj e-mail, aby odblokować pełną treść i cały serwis. Zapiszemy Cię do newslettera.

Powiązane

Twoje narzędzie pisze kod, którego skaner zobaczy dopiero po fakcie Bezpieczeństwo

Twoje narzędzie pisze kod, którego skaner zobaczy dopiero po fakcie

4 min

Agentowe pisanie kodu psuje stary układ, w którym skaner sprawdzał gotowy kod, bo między napisaniem a kontrolą nie ma już człowieka pilnującego narzędzia. Z tej luki wyrósł nowy gatunek produktów, które Techloy zebrał w zestawieniu siedmiu platform na 2026 rok: od Apiiro sprawdzającego zmianę po fakcie, przez Arnicę wstrzykującą reguły wprost do Claude czy Cursora w chwili generowania, po narzędzia pilnujące wdrożeń i agentów poza repozytoriami. Że to realna kategoria, potwierdza AMTSO, które otworzyło do recenzji pierwsze wytyczne testowania agentów. Brakuje jednak twardych liczb.

Najtrudniejsze w pracy z agentem jest wiedzieć, kiedy kazać mu przestać Poradnik / Praktyka

Najtrudniejsze w pracy z agentem jest wiedzieć, kiedy kazać mu przestać

5 min

Menedżer produktu Zephyr w Espressif opisuje, jak po raz drugi zbudował to samo firmware z pomocą agenta, tym razem w C zamiast Rust, i wyciąga z tego jeden wniosek: skoro model pisze kod szybciej, niż człowiek nadąża go ocenić, praca nie znika, tylko przenosi się z pisania na ocenianie. Jego receptą jest rytm plan, wykonanie, commit, test, z commitem przed testowaniem, żeby zawsze był punkt powrotu. Reszta reguł pilnuje granic: kodu z upstreamu agent nie rusza bez pozwolenia, a dziennik prób chroni przed zapętlaniem nieudanych poprawek.

Co się dzieje z uwagami, które wpisujesz agentowi tuż przed końcem sesji? Premiera / Narzędzie

Co się dzieje z uwagami, które wpisujesz agentowi tuż przed końcem sesji?

5 min

Warp opisał u Anthropica układ dwóch umiejętności: bazowa trzyma zasady przeglądu kodu, a druga rusza z harmonogramu, zbiera uwagi ludzi i proponuje jedną małą poprawkę do pliku bazowego, która wchodzi zwykłym pull requestem. Publiczne demo z agentem porządkującym zgłoszenia pokazuje całą pętlę, a komenda Skill Doctor ocenia wcześniejsze rozmowy agenta i podsuwa gotowy diff. Kupuję ten wzorzec z jednym zastrzeżeniem: uwagi ludzi prawie zawsze mówią, czego agentowi zabrakło, więc plik SKILL.md tylko puchnie, a im dłuższy, tym gorzej agent trafia do właściwej wiedzy.