Google обновила журнал изменений Gemini API: с 15 сентября 2026 года в общем доступе появились две новые модели для голосовых приложений — gemini-3.8-live и gemini-3.8-live-extended-thinking.

Первая рассчитана на голосовых агентов с минимальной задержкой: пользователь говорит, система отвечает почти сразу, а разработчик может строить поверх этого помощников, операторов поддержки, обучающие сценарии или интерфейсы без клавиатуры.

Вторая версия, Gemini 3.8 Live Extended Thinking, нужна там, где голосовому агенту недостаточно мгновенной реакции. Модель может использовать более глубокое фоновое рассуждение, поэтому подходит для сложных диалогов: например, когда нужно сопоставить несколько фактов, вызвать инструменты и не потерять ход разговора.

Для разработчиков важны не только сами модели, но и детали вокруг них. В обновлении Google отмечает чередование рассуждений с ответами, асинхронный вызов функций и полное обновление пользовательского контента в рамках сессии. Иными словами, голосовой агент теперь может не просто отвечать репликами, а параллельно думать, обращаться к инструментам и поддерживать более живой контекст беседы.

Это не такой громкий запуск, как новая флагманская текстовая модель, но для рынка голосовых ИИ-интерфейсов он заметен: Google переводит более продвинутые возможности живого звука из предварительных режимов в обычный рабочий слой API.