Gemini 3.8 Live сочетает голосовой диалог с обработкой визуального контекста. Модель автоматически распознает и переключается между 97 языками прямо во время разговора. Она также способна выполнять вызовы инструментов и API в фоновом режиме. Пользователь сможет продолжать разговаривать с ИИ, пока тот одновременно выполняет порученную задачу.
Gemini 3.8 Live Extended Thinking рассчитана на более сложные задачи. Она может одновременно говорить и выполнять многошаговое рассуждение, озвучивая промежуточные сигналы вроде «Позвольте мне это проверить…». Модель может использовать инструменты и выполнять длительные задачи в фоне, не прерывая диалог. Google приводит в качестве примеров многоэтапное бронирование, создание компонентов React по эскизу и составление бизнес-планов.
Google также приводит результаты тестов независимых и внутренних бенчмарков. Gemini 3.8 Live Extended Thinking получила 82,6 балла в рейтинге качества преобразования речи в речь Artificial Analysis, 68,6% в тесте 𝜏-Voice и 35,1% в 𝜏-Voice-banking от Sierra. В Big Bench Audio модель набрала 97,7%. При этом Google подчеркивает, что Extended Thinking сохраняет конкурентоспособную стоимость по сравнению с другими продвинутыми моделями.




Обычная Gemini 3.8 Live, в свою очередь, заняла второе место в рейтинге Speech Agent Arena. Google позиционирует ее как более экономичную модель для разработчиков и компаний, которым нужны голосовые агенты с высокой производительностью. На тесте ServiceNow EVA-Bench обе модели показали способность сочетать точность выполнения сложных рабочих процессов с качеством диалога.
Новые модели также работают с визуальной информацией.
Gemini 3.8 Live может анализировать происходящее перед камерой практически в реальном времени, например, помогать сотруднику осваивать новую работу или играть с пользователем в шахматы. Google также встроила модели в Search и Workspace: с их помощью можно голосом работать с документами, почтой и заметками, а также получать пошаговую помощь при решении технических проблем.
Gemini 3.8 Live уже начинает распространяться через Gemini API и Google AI Studio, а для корпоративных клиентов доступна в закрытом тестировании Gemini Enterprise. Для обычных пользователей она появляется в Search Live. Gemini 3.8 Live Extended Thinking также запускается в API и AI Studio, а пользователи могут работать с ней в Gemini Live. Кроме того, модель доступна в некоторых функциях Google Workspace для подписчиков Google AI. Все аудио, созданное продуктами Google на основе ИИ, компания помечает водяным знаком SynthID.

