SmartDigest Tworzone przez AI, żeby nadążyć za AI
Zapisz się

Zapisz się do newslettera

Co tydzień najważniejsze newsy AI prosto na Twój e-mail. Wybierz tematy, które Cię interesują.

Premiera / Narzędzie

Testy pisze już AI. TypeMock chce sprawdzać, które z nich mają sens

Skoro asystenci AI generują testy jednostkowe szybciej, niż ktokolwiek zdąży je przejrzeć, TypeMock ogłosił 22 czerwca narzędzie Test Review, które ma wskazywać, które z nich warto trzymać. Zamiast czytać sam kod, obserwuje testy w trakcie wykonania: ile kodu realnie dotykają i czy nie ukrywają zależności od plików czy sieci, które stoją za migającymi testami. Założyciel Eli Lopian ujmuje to wprost: przechodzący test nie jest automatycznie przydatny. Diagnoza jest trafna, ale to wciąż zapowiedź producenta, którą trzeba sprawdzić na własnym kodzie.

Napisała AI, żeby oszczędzić Ci czytania setek źródeł.  ·  Jak to działa

Premiera / Narzędzie  ·  4 min  · 

Testy pisze już AI. TypeMock chce sprawdzać, które z nich mają sens
Ilustrację przygotowała AI.

Przez ostatnie lata problemem było napisanie wystarczającej liczby testów jednostkowych, tych małych sprawdzianów, które uruchamia się przy każdej zmianie kodu, żeby upewnić się, że pojedyncza funkcja nadal robi to, co powinna. Pisanie ich ręcznie jest żmudne, więc deweloperzy chętnie oddali tę robotę asystentom AI. I tu pojawia się nowy kłopot: kiedy testy generuje model, przybywa ich szybciej, niż ktokolwiek jest w stanie je przejrzeć, a połowa z nich może nie sprawdzać niczego sensownego. TypeMock, firma od lat zajmująca się narzędziami do testów jednostkowych dla platformy .NET, ogłosiła 22 czerwca nowe narzędzie o nazwie Test Review, które ma odpowiadać właśnie na to pytanie: które z tych wygenerowanych testów w ogóle warto trzymać.

Problem nie jest już w tym, ile testów masz, tylko które są warte utrzymania

Najlepiej ujął to sam założyciel firmy. "Przez lata branża skupiała się na tworzeniu większej liczby testów", powiedział Eli Lopian, założyciel i prezes TypeMock. "Dziś wyzwaniem jest zrozumienie, które testy zasługują na istnienie. Przechodzący test nie jest automatycznie testem przydatnym." To zdanie jest sednem całej sprawy. Test, który zawsze kończy się na zielono, wygląda na sukces, ale jeśli sprawdza coś trywialnego albo dubluje inny test, to tylko wydłuża czas każdego uruchomienia i daje fałszywe poczucie, że kod jest dobrze pokryty testami. Lopian nazywa to wprost: takie testy nie zwiększają pewności, zwiększają tylko koszt utrzymania.

Czytaj dalej za darmo

Podaj e-mail, aby odblokować pełną treść i cały serwis. Zapiszemy Cię do newslettera.

Powiązane

AI pisze 80% testów, resztę wciąż dopina człowiek Analiza / Opinia

AI pisze 80% testów, resztę wciąż dopina człowiek

4 min

Suneet Malhotra, od dwudziestu lat budujący automatyzację testów, rozkłada slogan o AI piszącej 80% testów: model przejmuje 80% klepania w klawiaturę, nie 80% inżynierii, a cała trudność tkwi w pozostałych 20%. Jego pipeline zamienia projekt z Figmy w testy WebDriverIO w jakieś 16 minut, ale kładła go nie halucynacja modelu, tylko hydraulika wokół niego: backend gubił dane logowania, a przestawiona zmienna kazała agentom generować puste dokumenty. Cztery podręcznikowe zabezpieczenia to naprawiły, a człowiekowi i tak zostaje od 20 do 30 procent wysiłku, głównie na przeglądaniu.

Microsoft pozwala AI napisać test tylko raz, resztę robi już zwykły skrypt Premiera / Narzędzie

Microsoft pozwala AI napisać test tylko raz, resztę robi już zwykły skrypt

3 min

Zespół Commerce Platforms w Microsofcie obszedł konflikt między probabilistyczną naturą AI a wymogiem, by test zgodności za każdym razem przebiegał identycznie: agent tylko raz układa przypadki testowe z istniejącej dokumentacji, człowiek je zatwierdza, a wynik zostaje zamrożony w deterministyczny skrypt, którego AI już nie dotyka. Drugi agent podważa to, co stworzył pierwszy, zanim cokolwiek zostanie zatwierdzone. Cotygodniowe testy regresji przy migracji Global Trade Services na SAP S/4HANA spadły z trzech dni do niespełna godziny, choć liczby pochodzą wyłącznie z firmowego bloga Microsoftu.

Microsoft otwiera agenta, który czyta repozytorium, zanim napisze testy Premiera / Narzędzie

Microsoft otwiera agenta, który czyta repozytorium, zanim napisze testy

4 min

Microsoft udostępnił na licencji MIT agenta code-testing-generator, który zanim napisze testy jednostkowe, przeszukuje repozytorium, wykrywa język i framework oraz ustala prawdziwe komendy budowania. Na wewnętrznym benchmarku ze 152 zadań zaliczył 140 wobec 120 Copilota na tym samym modelu, czyli o 63% mniej porażek. Cały zysk skupia się w ogólnikowych poleceniach typu „napisz testy”, gdzie liczba porażek spadła z 30 do 10; przy szczegółowych promptach oba wypadły tak samo. To nie przełom, tylko porządne rusztowanie automatyzujące nudne rozeznanie pomijane przy jednej linijce polecenia.