Dwa modele, różne zadania

Gemini 3.8 Live jest pozycjonowany jako model do płynnej rozmowy, z uwzględnianiem obrazu i naciskiem na koszt oraz skalę. Wariant Extended Thinking przeznaczono do bardziej złożonych, wieloetapowych zadań.

Google opisuje wywoływanie narzędzi w tle podczas kontynuowania dialogu. Extended Thinking może jednocześnie rozumować i mówić, na przykład informować o postępie zadania. To deklaracje producenta, nie wynik naszego porównania.

Po co prowadzić rozmowę podczas działania narzędzia?

Wyobraź sobie umawianie wizyty. Asystent szuka terminu, a Ty dopowiadasz, że możesz przyjść dopiero po szesnastej. W użytecznym rozwiązaniu ta poprawka powinna dotrzeć do zadania, zanim zostanie zatwierdzona rezerwacja.

To nasz przykład problemu do rozwiązania, a nie opis gotowej funkcji każdego konta. Sama zdolność modelu do rozmowy nie daje mu dostępu do kalendarza ani prawa do zapisania wizyty. Aplikacja potrzebuje połączenia z usługą, uprawnień i obsługi sytuacji, w której usługa nie odpowiada.

Gdzie Google udostępnia modele?

Ogłoszenie wymienia Gemini API i Google AI Studio dla programistów. W usługach konsumenckich 3.8 Live trafia do Search Live, a Extended Thinking do Gemini Live i wybranych funkcji Workspace. Dostęp w Workspace zależy od usługi i planu; część rozwiązań firmowych pozostaje w prywatnym preview.

Lista produktów nie jest gwarancją identycznych funkcji na każdym koncie, w każdym kraju i języku. Przed planowaniem wdrożenia sprawdź aktualny dostęp w usłudze, której chcesz używać.

Jak ocenić takie rozwiązanie w praktyce?

Przy demonstracji zwrócilibyśmy uwagę na cały przebieg zadania. Czy asystent zapisuje poprawkę? Czy rozróżnia propozycję terminu od potwierdzonej rezerwacji? Czy po błędzie narzędzia przyznaje, że czynność nie została wykonana?

W scenariuszu korzystającym z kamery warto zapytać, jaki obraz został rzeczywiście przekazany. Płynny opis otoczenia nie dowodzi poprawnego odczytu drobnego tekstu, numeru czy szczegółu widocznego tylko przez moment.

Do pierwszej próby wybralibyśmy nieszkodliwe zadanie z łatwym do sprawdzenia końcem, bez płatności i wysyłania wiadomości do klientów. Dopiero później ocenialibyśmy, czy narzędzie nadaje się do procesu wymagającego większej odpowiedzialności.

A co z GPT-Live-1?

W naszym materiale o GPT-Live-1 omawiamy jednoczesne mówienie i słuchanie. Tu przyglądamy się również pracy narzędzi w tle. Nie wskazujemy zwycięzcy na podstawie osobnych prezentacji producentów.

Rzetelne porównanie wymagałoby tych samych poleceń, języka, uprawnień i kryteriów zaliczenia. Jeśli interesuje Cię opłacalność wdrożenia, zacznij od poradnika pomiaru wartości AI.

Źródła i metodologia

Google: 15 września 2026, aktualizacja 17 września ↗

Omówienie ogłoszenia Google, z uwzględnieniem aktualizacji z 17 września. Źródło sprawdzone 21 września 2026. Nie jest to nasz test modelu. Przykłady zastosowań i kryteria oceny są propozycjami redakcji, nie wynikami pomiaru.

Weryfikacja źródeł: 21 września 2026. Masz pytanie lub zauważyłeś błąd? Napisz do redakcji.