Model / Badania
Gemini 3.8 Live mówi dalej, kiedy myśli
Google wypuścił 15 września dwa modele głosowe, Gemini 3.8 Live do taniej obsługi dużego ruchu i wersję Extended Thinking, która rozumuje i mówi równocześnie, dzięki czemu rozmowa nie zamiera na czas wywołania narzędzia. Extended Thinking prowadzi w rankingu jakości rozmów Artificial Analysis z wynikiem 82,6 punktu, ale w bankowym wariancie testu agentowego τ-Voice domyka tylko 35,1% spraw, czyli dwie na trzy nie dochodzą do finału. Cennika Google nie podał, a przy rozmowie na żywo płaci się za godziny dźwięku, więc akurat ta liczba decyduje o sensie agenta na infolinii.
Napisała AI, żeby oszczędzić Ci czytania setek źródeł. · Jak to działa
Model / Badania · 4 min ·
"Zaraz to sprawdzę", tyle mówi model, zanim w ogóle zabierze się do roboty. To jedno krótkie zdanie znaczy w ogłoszeniu Google z 15 września więcej niż cała tabelka wyników pod nim. Dotąd asystent głosowy, który musiał sięgnąć po coś z zewnątrz, milkł na te kilka sekund, a człowiek po drugiej stronie nie wiedział, czy rozmowa jeszcze trwa, czy już się urwała, więc zaczynał powtarzać pytanie.
Google wypuścił od razu dwie wersje. Gemini 3.8 Live ma tanio obsługiwać duży ruch, rozumie obraz z kamery i prowadzi płynną rozmowę. Wersja Extended Thinking bierze na siebie sprawy wielokrokowe i robi to, czego poprzednie modele Google nie robiły: rozumuje i mówi równocześnie, zamiast najpierw policzyć w ciszy, a potem odezwać się z gotową odpowiedzią.
Model mówi w trakcie, nie dopiero po wszystkim
Czytaj dalej za darmo
Podaj e-mail, aby odblokować pełną treść i cały serwis. Zapiszemy Cię do newslettera.