Premiera / Narzędzie
Cognition dostawia tani model do drogiego i ścina koszty o 35%
Cognition, twórca agenta Devin, wypuściło w podglądzie Devin Fusion, warstwę, która do drogiego topowego modelu dokłada drugi, znacznie tańszy, i każe im pracować równolegle: główny model planuje i robi przegląd, a pomocnik czyta pliki i wprowadza drobne zmiany. Cały zysk bierze się z cache, bo oba modele trzymają własny kontekst, a przełączanie między nimi wypada wtedy, gdy sesja i tak streszcza kontekst, więc wychodzi za darmo. Obiecane 35% oszczędności przy jakości Opusa 4.8 brzmi mocno, tylko że benchmark FrontierCode, na którym Fusion wypada tak dobrze, Cognition zbudowało samo.
Napisała AI, żeby oszczędzić Ci czytania setek źródeł. · Jak to działa
Premiera / Narzędzie · 3 min ·
Najdroższe modele zjadają budżet, a puszczanie ich do każdego drobiazgu dawno przestało mieć sens. Cognition, firma stojąca za agentem kodującym Devin, wypuściła właśnie w podglądzie Devin Fusion, harness nowego typu. Harness otacza model i decyduje, co model widzi, jakich narzędzi może użyć i jak długo pracuje nad zadaniem. Fusion do drogiego, topowego modelu dokłada drugi, znacznie tańszy, i każe im pracować równolegle. Obietnica jest konkretna: ta sama jakość kodu co przy samym topowym modelu, przy koszcie niższym o 35%.
Cognition nie owija tego w bawełnę. Jak tłumaczą na swoim blogu, istniejące narzędzia do mieszania modeli są kiepskie: ładnie wyglądają na benchmarkach, ale nie piszą kodu, który naprawdę chciałbyś zmergeować. Samą diagnozę trudno podważyć, bo koszt topowych modeli i w małych, i w dużych zespołach dobił do poziomów, przy których liczy się już każdy token. Jak ujmuje to Cognition: nie jeździ się Lamborghini po zakupy, więc po co puszczać model zdolny znaleźć lukę zero-day do zaokrąglania rogu przycisku.
Jeden model planuje, drugi robi czarną robotę
Czytaj dalej za darmo
Podaj e-mail, aby odblokować pełną treść i cały serwis. Zapiszemy Cię do newslettera.