Dwa modele, różne zadania
Gemini 3.8 Live jest pozycjonowany jako model do płynnej rozmowy, z uwzględnianiem obrazu i naciskiem na koszt oraz skalę. Wariant Extended Thinking przeznaczono do bardziej złożonych, wieloetapowych zadań.
Google opisuje wywoływanie narzędzi w tle podczas kontynuowania dialogu. Extended Thinking może jednocześnie rozumować i mówić, na przykład informować o postępie zadania. To deklaracje producenta, nie wynik naszego porównania.
Po co prowadzić rozmowę podczas działania narzędzia?
Wyobraź sobie umawianie wizyty. Asystent szuka terminu, a Ty dopowiadasz, że możesz przyjść dopiero po szesnastej. W użytecznym rozwiązaniu ta poprawka powinna dotrzeć do zadania, zanim zostanie zatwierdzona rezerwacja.
To nasz przykład problemu do rozwiązania, a nie opis gotowej funkcji każdego konta. Sama zdolność modelu do rozmowy nie daje mu dostępu do kalendarza ani prawa do zapisania wizyty. Aplikacja potrzebuje połączenia z usługą, uprawnień i obsługi sytuacji, w której usługa nie odpowiada.
Gdzie Google udostępnia modele?
Ogłoszenie wymienia Gemini API i Google AI Studio dla programistów. W usługach konsumenckich 3.8 Live trafia do Search Live, a Extended Thinking do Gemini Live i wybranych funkcji Workspace. Dostęp w Workspace zależy od usługi i planu; część rozwiązań firmowych pozostaje w prywatnym preview.
Lista produktów nie jest gwarancją identycznych funkcji na każdym koncie, w każdym kraju i języku. Przed planowaniem wdrożenia sprawdź aktualny dostęp w usłudze, której chcesz używać.
Jak ocenić takie rozwiązanie w praktyce?
Przy demonstracji zwrócilibyśmy uwagę na cały przebieg zadania. Czy asystent zapisuje poprawkę? Czy rozróżnia propozycję terminu od potwierdzonej rezerwacji? Czy po błędzie narzędzia przyznaje, że czynność nie została wykonana?
W scenariuszu korzystającym z kamery warto zapytać, jaki obraz został rzeczywiście przekazany. Płynny opis otoczenia nie dowodzi poprawnego odczytu drobnego tekstu, numeru czy szczegółu widocznego tylko przez moment.
Do pierwszej próby wybralibyśmy nieszkodliwe zadanie z łatwym do sprawdzenia końcem, bez płatności i wysyłania wiadomości do klientów. Dopiero później ocenialibyśmy, czy narzędzie nadaje się do procesu wymagającego większej odpowiedzialności.
A co z GPT-Live-1?
W naszym materiale o GPT-Live-1 omawiamy jednoczesne mówienie i słuchanie. Tu przyglądamy się również pracy narzędzi w tle. Nie wskazujemy zwycięzcy na podstawie osobnych prezentacji producentów.
Rzetelne porównanie wymagałoby tych samych poleceń, języka, uprawnień i kryteriów zaliczenia. Jeśli interesuje Cię opłacalność wdrożenia, zacznij od poradnika pomiaru wartości AI.
Źródła i metodologia
Google: 15 września 2026, aktualizacja 17 września ↗
Omówienie ogłoszenia Google, z uwzględnieniem aktualizacji z 17 września. Źródło sprawdzone 21 września 2026. Nie jest to nasz test modelu. Przykłady zastosowań i kryteria oceny są propozycjami redakcji, nie wynikami pomiaru.
Weryfikacja źródeł: 21 września 2026. Masz pytanie lub zauważyłeś błąd? Napisz do redakcji.


