AI · 27 сентября 2026, 14:26

Google DeepMind представила Gemini 3.8 Live с функцией Live Avatar

Google DeepMind добавила в модель живого диалога Gemini 3.8 Live функцию Live Avatar, которая в реальном времени генерирует видеоаватар с мимикой и синхронизацией губ. Возможность уже доступна в Gemini Enterprise.

Live Avatar сочетает генерацию видео в почти реальном времени со speech-моделью, создавая визуального собеседника, который слушает, видит и говорит. Поддерживаются точная синхронизация губ, естественная мимика и плавная смена говорящего. По заявлению компании, функция ориентирована на корпоративных клиентов — для интерактивного обслуживания, виртуальных ассистентов и презентаций.

Аватар работает на базе рассуждений Gemini и поддерживает асинхронный вызов инструментов: во время диалога модель может в фоне обращаться к внешним сервисам и подгружать данные, не прерывая разговор. Live Avatar распознаёт и переключается между 97 языками без потери качества видео и рассинхронизации мимики.

Помимо библиотеки готовых аватаров, компании могут создавать собственные по референсному изображению, сохраняя сходство и фирменный стиль. Кастомные аватары пока доступны только по корпоративному вайтлисту. Весь аудио- и видеовыход помечается водяным знаком SynthID для маркировки сгенерированного контента.

Источник: Google DeepMind