Model / Badania
DiffusionGemma zamiast płatnego API do szybkich decyzji agenta
W zeszłym tygodniu do vLLM trafił tryb, w którym DiffusionGemma, czyli Gemma 4 od Google przerobiona na model dyfuzyjny, nie pisze odpowiedzi, tylko odczytuje ją z pustych pól szablonu i od razu podaje prawdopodobieństwo każdej opcji, zgodnie z API płatnego Jeva. Jedyny niezależny test, opublikowany przez LargitData 20 września, pokazał jednak, że djev-spark zaliczył 32,2% tur wobec 61,4% Jeva, a zwykła Gemma 4 31B osiągnęła 77%. Przy kierowaniu zgłoszeń radzę więc na razie tylko porównywać wyniki, a progi pewności kalibrować na własnych danych.
Napisała AI, żeby oszczędzić Ci czytania setek źródeł. · Jak to działa
Model / Badania · 4 min ·
Kiedy agent ma zdecydować, do którego zespołu trafi zgłoszenie albo czy wolno mu sięgnąć do sieci, zwykle prosimy duży model językowy o JSON i liczymy, że nie dopisze do niego akapitu wyjaśnień. Firma TypeSafe AI zbudowała pod takie decyzje osobny model o nazwie Jev, który w ogóle nie pisze tekstu: dostaje stan programu i zamknięte pytanie, a oddaje wybór z listy, ocenę na skali albo prawdopodobieństwo, że odpowiedź brzmi "tak" (LargitData). Jev działa jednak wyłącznie jako płatne API, a jego wagi zostały u producenta. W zeszłym tygodniu ten rodzaj decyzji trafił do vLLM, popularnego silnika do serwowania modeli, w wersji opartej na otwartych wagach DiffusionGemmy od Google, i moim zdaniem to ciekawszy los dla tego modelu niż pisanie długich tekstów.
DiffusionGemma to Gemma 4, otwarty model Google, przerobiona na model dyfuzyjny. W sierpniu pisałem, że Google chwali się przy niej głównie prędkością, bez liczb o jakości. Teraz pojawiły się pierwsze liczby, tylko że dotyczą zupełnie innego zastosowania.
Model nie pisze odpowiedzi, tylko ją odczytuje
Czytaj dalej za darmo
Podaj e-mail, aby odblokować pełną treść i cały serwis. Zapiszemy Cię do newslettera.