Modele AI · 5 min czytania · 17 września 2026

Gemini 3.8 Live: Google chce rozmowy z AI bez przerw i zacięć

Przejdź do treści i przykładów
Gemini 3.8 Live: Google chce rozmowy z AI bez przerw i zacięć

Źródło: Link

Rozmawiałeś kiedyś z asystentem głosowym i czekałeś, aż "pomyśli", a potem musiałeś powtarzać pytanie od nowa? Google właśnie ogłosił model, który ma z tym problemem skończyć - a przynajmniej tak twierdzi w opisie premiery.

15 września 2026 roku DeepMind zaprezentował Gemini 3.8 Live oraz Gemini 3.8 Live Extended Thinking - dwa modele stworzone specjalnie do rozmowy głosowej w czasie rzeczywistym. Za projektem stoi Tom Ouyang (Principal Engineer) razem z Malini Jaganathan z zespołu Gemini Audio Team. To nie jest kolejna aktualizacja czatu tekstowego. To modele zaprojektowane pod kątem tego, jak ludzie faktycznie mówią: chaotycznie, z dygresjami, czasem zmieniając zdanie w połowie zdania.

Gemini 3.8 Live ma prowadzić rozmowę głosową bez sztucznych przerw na "myślenie"

Rozmowa głosowa, która nie czeka na Twoją ciszę

Google opisuje te modele jako najbardziej zaawansowane modele do dialogu na żywo w swojej ofercie. Kluczowe słowo to "live" - w przeciwieństwie do standardowego czatu, gdzie piszesz, wysyłasz, czekasz na odpowiedź, tutaj chodzi o ciągłą rozmowę głosową. Model ma reagować płynnie, bez tego charakterystycznego zawieszenia, które zdradza, że rozmawiasz z maszyną.

Według Google, główne ulepszenia dotyczą trzech obszarów:

  • Złożonego rozumowania - model radzi sobie z trudniejszymi pytaniami bez utraty wątku rozmowy
  • Wizualnego kontekstu w czasie rzeczywistym - system reaguje na to, co widzi (np. przez kamerę telefonu), nie tylko na to, co słyszy
  • Wykonywania zadań w tle - model może "coś załatwić", gdy Ty dalej mówisz, zamiast przerywać dialog komunikatem "chwileczkę, sprawdzam"

To pozornie drobny szczegół. Jeśli kiedykolwiek dyktowałeś asystentowi listę zakupów i czekałeś, aż "skończy przetwarzać", wiesz, że to właśnie ten moment psuje całe doświadczenie.

Czym różni się wersja Extended Thinking

Obok podstawowego Gemini 3.8 Live pojawia się wariant Extended Thinking. Google wprowadza go dla sytuacji, gdzie zwykła szybka odpowiedź nie wystarczy - zadanie wymaga dłuższego namysłu, ale rozmowa i tak ma płynąć dalej. To praktyczne rozwiązanie realnego konfliktu: chcesz szybki refleks w rozmowie, ale czasem pytanie jest na tyle złożone, że model powinien się nad nim faktycznie zastanowić, zamiast rzucać pierwszą sensowną odpowiedź.

Firma podkreśla "równoległe rozumowanie" jako jedną z głównych zmian w tej generacji. W praktyce ma to oznaczać, że model może jednocześnie prowadzić rozmowę i pracować nad bardziej wymagającym elementem zadania w tle, zamiast robić to sekwencyjnie - najpierw myśl, potem odpowiedź, potem kolejna myśl.

Równoległe rozumowanie ma pozwolić modelowi myśleć i mówić jednocześnie

Po co komu asystent, który nie przerywa

Komu to w ogóle potrzebne poza demo na konferencji? Odpowiedź jest prosta: każdemu, kto próbował użyć głosowego asystenta AI do czegoś poważniejszego niż ustawienie budzika. Modele głosowe od lat mają ten sam problem - świetnie radzą sobie z krótkimi komendami, ale przy dłuższej, złożonej rozmowie zaczynają się gubić albo wymuszają niewygodne przerwy.

Google celuje w scenariusze, gdzie głos staje się głównym interfejsem do wykonywania zadań, a nie dodatkiem do klawiatury. To wpisuje się w szerszy trend, który widać zresztą i u konkurencji - OpenAI ze swoim GPT-6 Astra też stawia na modele, które mają rozumieć więcej niż tylko tekst wpisany z klawiatury.

Google iteruje na rodzinie Gemini 3.8 zaskakująco szybko - to kolejna premiera w krótkim odstępie po Gemini 3.8 Flash, który pojawił się zaledwie kilka tygodni wcześniej. Firma najwyraźniej postawiła na tempo wydawania nowych wariantów zamiast czekania na jedną wielką premierę raz na rok.

Kontekst wizualny w czasie rzeczywistym to zresztą temat, który pojawia się teraz u wielu graczy na rynku - podobny kierunek widać choćby w podejściu DeepSeek do modeli rozumiejących obraz z ekranu. Różnica jest taka, że Google od razu łączy to z rozmową głosową, a nie tylko z analizą statycznego obrazu.

Głosowe AI to nie magia dla wtajemniczonych. Jeśli chcesz zrozumieć, jak modele takie jak Gemini faktycznie działają i jak wykorzystać je w codziennej pracy, zacznij od podstaw na żywym spotkaniu. Zapisz się na darmowy webinar →

Zostaje pytanie, na które sam news nie odpowiada wprost: czy "płynność" rozmowy faktycznie przełoży się na realną różnicę w codziennym użyciu, czy zostanie efektowną prezentacją, która w praktyce i tak wymaga cierpliwości użytkownika. Google historycznie lubi pokazywać demo, które robi wrażenie na scenie, a w codziennym użyciu bywa bardziej przyziemnie. Odpowiedź poznamy dopiero, gdy zwykli użytkownicy zaczną testować to na własnych, bałaganiarskich rozmowach - nie na wyreżyserowanym pokazie.

Najczęstsze pytania

Czym różni się Gemini 3.8 Live od zwykłego Gemini 3.8?

Gemini 3.8 Live to model zaprojektowany specjalnie do rozmowy głosowej w czasie rzeczywistym, z naciskiem na płynność dialogu, kontekst wizualny i wykonywanie zadań w tle bez przerywania konwersacji. To odrębny wariant od standardowych modeli tekstowych z tej rodziny, jak np. Gemini 3.8 Flash.

Co oznacza "Extended Thinking" Jeśli chodzi o modeli głosowych?

To wariant modelu przeznaczony do sytuacji, gdy zadanie wymaga dłuższego namysłu, ale rozmowa ma mimo to płynąć dalej. Google opisuje to jako element "równoległego rozumowania", które ma pozwolić modelowi jednocześnie prowadzić dialog i pracować nad bardziej złożonym problemem.

Do czego praktycznie służy kontekst wizualny w czasie rzeczywistym?

Model może reagować na to, co widzi (np. przez kamerę urządzenia) w trakcie rozmowy głosowej, a nie tylko na to, co słyszy. Google podaje to jako jedno z głównych ulepszeń tej generacji modeli Live.

Czy Gemini 3.8 Live zastąpi standardowy czat tekstowy Google?

Nic w materiale źródłowym na to nie wskazuje - to raczej dodatkowy tryb pracy z AI, skierowany do scenariuszy głosowych i zadań wykonywanych "na żywo", a nie zamiennik dla klasycznego czatu tekstowego.

Na podstawie: DeepMind Blog

Informacje o artykule

Darmowy AI Starter Kit

10 gotowych promptów do codziennej pracy + 5 narzędzi + plan na pierwszy tydzień. PDF, 4 strony konkretu.

Udostępnij:
Nie przegap nowych artykułów - dodaj SukcesAI do swoich źródeł w wyszukiwarce Google.
Dodaj do preferowanych źródeł
Jan Gajos

Ekspert AI & Founder, AI Evolution

Pasjonat sztucznej inteligencji, który od 18 lat działa z sukcesem biznesowo i szkoleniowo. Wprowadzam AI do swoich firm oraz codziennego życia. Fascynują mnie nowe technologie, gry wideo i składanie klocków Lego - tam też widzę logikę i kreatywność, które AI potrafi wzmacniać. Wierzę, że dobrze użyta sztuczna inteligencja to nie ogłupiające ułatwienie, lecz prawdziwy przełom w sposobie, w jaki myślimy, tworzymy i pracujemy.