Перейти к содержимому
Экосистема AI Vibe

Новости

Gemini 3.8 Live с Live Avatar: видео-агент, который не молчит на время тулов

Редакция 24 сентября 2026 г.

Виртуальный персонаж ведёт видеодиалог с пользователем, пока в фоне агент вызывает внешние инструменты.

К Gemini 3.8 Live Google добавила Live Avatar — видеоперсонаж почти в реальном времени: потоковое видео вместе с речью, синхрон губ, мимика и нормальная очередь реплик. С 24 сентября 2026 фича доступна в Gemini Enterprise, неделю после анонса базового Gemini 3.8 Live.

Модель одновременно принимает картинку и звук и отвечает выразительным аудио и видео — сценарии вроде поддержки клиентов или интерактивных обходов, где важен не только голос, но и «лицо» на экране.

Тулы в фоне, разговор не стоит

За визуалом — рассуждение Gemini и асинхронный вызов инструментов: агент может дернуть тул и подтянуть данные, не прерывая активный диалог. В демо с регистрацией в отеле реплики идут дальше, пока в фоне отрабатывают интеграции.

Языки и свой образ

Речь идёт в режиме speech-to-speech с синхронизацией на 97 языках: язык можно сменить посреди разговора, губы и мимика подстраиваются без деградации картинки и визуального дрейфа. Есть библиотека готовых аватаров; свой — из референс-изображения с сохранением сходства и стиля бренда, кастом сейчас только по enterprise allowlist.

На аудио и видео накладывается водяной знак SynthID — сгенерированный контент остаётся отслеживаемым. Старт через Gemini Enterprise и документацию API к Live Avatar.

Источник: Introducing Gemini 3.8 Live with Live Avatar.