SmartDigest.ai Tworzone przez AI, żeby nadążyć za AI
Zapisz się

Zapisz się do newslettera

Co tydzień najważniejsze newsy AI prosto na Twój e-mail. Wybierz tematy, które Cię interesują.

Analiza / Opinia

Agent czyta specyfikację API sam i nie ma kogo dopytać

Analiza kategorii integracji i API z zestawienia SD Times 100 na 2026 rok stawia tezę, że po drugiej stronie wywołania API coraz częściej stoi agent AI, który sam czyta dokumentację i sam decyduje, jak jej użyć, zamiast wykonywać z góry napisany skrypt. Dwuznaczność, którą człowiek wyjaśniłby sobie krótkim pytaniem, dla agenta staje się twardym błędem, więc nazwy parametrów i komunikaty o błędach awansują z kosmetyki do właściwego interfejsu. Zmiana odbiorcy uderza też w limity zapytań i w uprawnienia, choć to wciąż argument redakcji bez liczb o wdrożeniach.

Napisała AI, żeby oszczędzić Ci czytania setek źródeł.  ·  Jak to działa

Analiza / Opinia  ·  3 min  · 

Agent czyta specyfikację API sam i nie ma kogo dopytać
Ilustrację przygotowała AI.

Przez dwie dekady, kiedy jakiś program wołał API, po drugiej stronie zawsze był człowiek. Ktoś wcześniej przeczytał dokumentację, zrozumiał, jak zbudować zapytanie, i zapisał tę logikę w kodzie. Wywołanie było więc przewidywalne: znany kształt zapytania, znane sposoby, w jakie może się wysypać. SD Times w analizie kategorii integracji i API z tegorocznego zestawienia SD Times 100 twierdzi, że ten układ właśnie się kończy, bo po drugiej stronie coraz częściej jest agent AI, który dokumentację czyta sam i na jej podstawie sam decyduje, jak wywołać dane API.

To brzmi jak drobiazg, ale nim nie jest. Agent nie wykonuje z góry napisanego skryptu. Eksploruje, próbuje raz za razem na sposoby, których nikt nie przewidział, i skleja kolejne wywołania w łańcuch na bieżąco, w oparciu o to, co model akurat sobie wyrozumował, a nie o gotową ścieżkę zaplanowaną przez programistę. Cała analiza sprowadza się właściwie do jednego zdania: dwuznaczność, którą człowiek zbyłby wzruszeniem ramion i wyjaśnił sobie krótkim pytaniem na firmowym czacie, dla samodzielnego agenta staje się twardym błędem. Model nie dopyta. Albo specyfikacja mówi mu jednoznacznie, jak nazywa się parametr i co dokładnie oznacza błąd, albo agent skorzysta z API źle i nawet tego nie zauważy.

Dla mnie nowość jest tu wąska, ale prawdziwa. W samych specyfikacjach nie ma nic nowego. Maszynowo czytelne opisy API w rodzaju OpenAPI istnieją od lat. Zmienił się ten, kto je czyta. Kiedyś była to wygenerowana biblioteka klienta, która przy braku danych wywalała się głośno i przewidywalnie. Teraz jest to model, który lukę w opisie obejdzie improwizacją i po cichu zrobi coś nie tak. To awansuje dokumentację i nazewnictwo parametrów z czegoś miłego, ale drugorzędnego, do właściwego interfejsu, przez który agent styka się z systemem.

Czytaj dalej za darmo

Podaj e-mail, aby odblokować pełną treść i cały serwis. Zapiszemy Cię do newslettera.

Powiązane

Astryx: agent czyta jeden plik JSON i zna całe API, zamiast je zmyślać Premiera / Narzędzie

Astryx: agent czyta jeden plik JSON i zna całe API, zamiast je zmyślać

5 min

Meta udostępniła na licencji MIT Astryx, system komponentów Reacta, który przez osiem lat napędzał ponad 13 tysięcy wewnętrznych aplikacji firmy. Najważniejszy jest tu jeden plik JSON, manifest, który daje agentom AI maszynowo czytelny opis całego narzędzia, dzięki czemu nie muszą zgadywać API ani zmyślać nieistniejących właściwości. Pod spodem działa sprawdzony silnik StyleX, używany też przez Figmę i Snowflake, a dostęp prowadzi również przez serwer MCP. W dniu premiery repozytorium miało jednak 18 gwiazdek i status bety, więc poza Metą nie ma jeszcze społeczności ani pełnej dokumentacji.

Kod da się sprawdzić i na tym stoi cała przewaga agentów Analiza / Opinia

Kod da się sprawdzić i na tym stoi cała przewaga agentów

4 min

Phillip Isola z MIT tłumaczy w rozmowie dla MIT News, dlaczego z całej fali agentów AI naprawdę wypaliła tylko jedna kategoria: te do pisania kodu. Powód jest prozaiczny, kod da się sprawdzić, więc agent może odpalić własne rozwiązanie, napisać test i kręcić pętlę prób i błędów, aż trafi na dobrą strategię, czego przy rezerwacji lotu czy w medycynie zrobić się nie da. Ta sama łatwość bywa jednak pułapką, bo przy vibe codingu człowiek świadomie rezygnuje z tej weryfikacji, przez co wkradają się błędy i wyciekają prywatne dane.

Agents SDK dzieli agenta na dwa procesy. Harness u OpenAI, sandbox u E2B albo Cloudflare Premiera / Narzędzie

Agents SDK dzieli agenta na dwa procesy. Harness u OpenAI, sandbox u E2B albo Cloudflare

4 min

Aktualizacja Agents SDK z 15 kwietnia rozdziela agenta na dwie warstwy: harness OpenAI trzyma klucze i pamięć kontekstu z pliku AGENTS.md, a wygenerowany kod biegnie w sandboxie u jednego z siedmiu dostawców, jak E2B, Cloudflare czy Vercel. Granica jest fizyczna, więc prompt injection nie sięga sekretów, a stan agenta żyje poza kontenerem — po awarii na kroku 19. z 20 SDK wczytuje snapshot zamiast startować od zera. Oscar Health odróżnia teraz granice wizyt w długich aktach pacjenta. Na razie tylko Python, w standardowym cenniku API.