Технологии

Google представила Gemini 3.8 Live и Live Extended Thinking: что известно о новых голосовых моделях

Google объявила о моделях Gemini 3.8 Live и Gemini 3.8 Live Extended Thinking. Первая ориентирована на масштабируемые голосовые сценарии и повышение эффективности, вторая — на сложные задачи с многоэтапным рассуждением. Обе модели работают с визуальными данными почти в реальном времени, поддерживают 97 языков и умеют выполнять инструментальные и API-вызовы в фоне, не прерывая разговор.

796 слов

Чем отличаются Gemini 3.8 Live и Live Extended Thinking

Gemini 3.8 Live предназначена прежде всего для масштабирования голосовых сценариев и повышения их эффективности. Вторая модель, Gemini 3.8 Live Extended Thinking, рассчитана на более сложные задачи, где требуется многоэтапное рассуждение.

Ключевое отличие Extended Thinking заключается в способности одновременно рассуждать и говорить. Это позволяет модели продолжать голосовое взаимодействие в процессе обработки сложной задачи, а не ограничиваться последовательной схемой «сначала анализ, затем ответ». Однако конкретные ограничения такой работы и полный перечень доступных сценариев Google не уточняла в приведённых материалах.

Визуальные данные, 97 языков и фоновые вызовы

Обе модели поддерживают обработку визуальных данных почти в реальном времени. Таким образом, голосовое взаимодействие может дополняться анализом визуальной информации. Источники не приводят полного списка поддерживаемых типов данных или требований к конкретным сценариям, поэтому возможности нельзя расширять за пределы заявленной обработки визуальной информации.

Во время разговора модели могут переключаться между 97 языками. Ещё одна заявленная функция — выполнение инструментальных и API-вызовов в фоне без прерывания диалога. Для пользователя это означает, что обращение к внешнему инструменту или сервису не обязательно должно останавливать голосовой обмен. При этом подробности реализации и перечень совместимых инструментов в доступных сведениях не раскрыты.

Где доступны новые модели

Для разработчиков Gemini 3.8 Live и Gemini 3.8 Live Extended Thinking доступны через Gemini API и Google AI Studio. Unite.AI описывает Live API как интерфейс для низколатентного голосового и визуального взаимодействия в реальном времени через WebSocket.

В продуктах Google Gemini 3.8 Live доступна в Search Live, а Gemini 3.8 Live Extended Thinking — в Gemini Live. При этом статус отдельных интеграций и категорий пользователей следует трактовать осторожно: источники используют разные формулировки, включая запуск, развёртывание и доступность.

3DNews сообщает, что платные подписчики AI Pro и Ultra могут обращаться к Gemini 3.8 Live Extended Thinking в Google Документах, Gmail и Keep. Однако другой источник формулирует доступ к Gmail и Keep шире, поэтому нельзя считать однозначно установленным, что эти возможности доступны всем подписчикам Google AI. Также сообщается о доступе корпоративных пользователей к обеим моделям через Gemini Enterprise, но будущую поддержку отдельных бизнес-сервисов нельзя выдавать за состоявшийся релиз.

Что известно о сроках и результатах тестов

Unite.AI сообщает, что обе модели начали разворачиваться 15 сентября 2026 года. Вместе с тем источники расходятся в описании статуса отдельных функций и интеграций, поэтому эту дату корректнее рассматривать как сообщение об этапе развёртывания, а не как подтверждение повсеместной доступности всех возможностей.

Unite.AI приводит заявленные Google результаты голосовых тестов. По данным источника, Gemini 3.8 Live Extended Thinking заняла первое место в Speech to Speech Quality Index Artificial Analysis с результатом 82,6. Также сообщается о лидерстве модели в бенчмарке τ-Voice-banking с показателем 35,1%, а Gemini 3.8 Live, по версии Google, заняла второе место в Artificial Analysis Speech Agent Arena.

Эти показатели представлены как заявления Google и источника, а не как результаты независимой проверки. Поэтому их следует воспринимать как заявленные результаты сравнительных тестов, а не как окончательное доказательство превосходства моделей во всех голосовых сценариях.

SynthID и что пока остаётся неизвестным

Google заявляет, что аудио, генерируемое её ИИ-продуктами, получает водяной знак SynthID. Это должно обозначать происхождение синтетического аудио, однако в доступных материалах нет подробного описания того, как именно пользователь сможет проверять такую маркировку.

Пока не установлен единый статус доступа ко всем функциям, сервисам и категориям пользователей. Не приведены полный список совместимых устройств и приложений, требования к работе моделей, а также перечень игр или других сторонних сценариев. Демонстрационные возможности нельзя автоматически считать общедоступными функциями. На практике разработчикам уже обозначены каналы подключения через Gemini API и Google AI Studio, а пользователям сервисов Google необходимо учитывать возможные различия по подписке и этапу развёртывания.

Частые вопросы

Что такое Gemini 3.8 Live?

Это модель Google, предназначенная для масштабируемых голосовых сценариев и повышения эффективности. Она поддерживает визуальные данные почти в реальном времени, 97 языков и фоновые инструментальные и API-вызовы.

Чем Gemini 3.8 Live Extended Thinking отличается от обычной Live?

Она ориентирована на сложные задачи и многоэтапное рассуждение. Google также заявляет, что модель может одновременно рассуждать и говорить.

Где разработчики могут использовать новые модели?

Модели доступны разработчикам через Gemini API и Google AI Studio. Live API описывается как интерфейс для низколатентного голосового и визуального взаимодействия в реальном времени через WebSocket.

Доступны ли модели всем пользователям Google?

Единого подтверждения такой доступности нет. Источники по-разному описывают статус развёртывания и доступ к отдельным сервисам, включая Gmail и Keep, поэтому нельзя утверждать, что все функции уже доступны всем пользователям.

Подтверждены ли заявленные результаты голосовых бенчмарков?

В доступных материалах они представлены как заявления Google, приведённые источником. Независимая проверка этих результатов не подтверждена.

Источники

  1. Google представила ИИ-модели Gemini 3.8 Live и Live Extended Thinking3DNews · 3dnews.ru
  2. Google Launches Gemini 3.8 Live and Extended Thinking Voice ModelsUnite.AI · unite.ai