Gemini 3.8 Live с Live Avatar: видео-агент, который не молчит на время тулов

К Gemini 3.8 Live Google добавила Live Avatar — видеоперсонаж почти в реальном времени: потоковое видео вместе с речью, синхрон губ, мимика и нормальная очередь реплик. С 24 сентября 2026 фича доступна в Gemini Enterprise, неделю после анонса базового Gemini 3.8 Live.
Модель одновременно принимает картинку и звук и отвечает выразительным аудио и видео — сценарии вроде поддержки клиентов или интерактивных обходов, где важен не только голос, но и «лицо» на экране.
Тулы в фоне, разговор не стоит
За визуалом — рассуждение Gemini и асинхронный вызов инструментов: агент может дернуть тул и подтянуть данные, не прерывая активный диалог. В демо с регистрацией в отеле реплики идут дальше, пока в фоне отрабатывают интеграции.
Языки и свой образ
Речь идёт в режиме speech-to-speech с синхронизацией на 97 языках: язык можно сменить посреди разговора, губы и мимика подстраиваются без деградации картинки и визуального дрейфа. Есть библиотека готовых аватаров; свой — из референс-изображения с сохранением сходства и стиля бренда, кастом сейчас только по enterprise allowlist.
На аудио и видео накладывается водяной знак SynthID — сгенерированный контент остаётся отслеживаемым. Старт через Gemini Enterprise и документацию API к Live Avatar.
Источник: Introducing Gemini 3.8 Live with Live Avatar.