Google добавила в Gemini 3.8 Live говорящий аватар, который переключается между 97 языками
Live Avatar сочетает живой диалог Gemini с генерацией видео почти в реальном времени: синхронизация губ, мимика и работа с инструментами в фоне. Функция уже доступна в Gemini Enterprise.

Что произошло
24 сентября Google представила Gemini 3.8 Live with Live Avatar — функцию, которая добавляет к голосовым моделям Gemini видеоаватар. Модель слушает, видит и отвечает от лица анимированного персонажа: генерация видео почти в реальном времени совмещена с речью, синхронизацией губ и мимикой.
Функция вышла через неделю после самой Gemini 3.8 Live и сразу доступна в Gemini Enterprise. Google предлагает её компаниям — например, для клиентской поддержки или интерактивных инструкций.
Что умеет
Аватар поддерживает 97 языков и может переключаться между ними прямо в разговоре — по словам Google, без потери качества видео. Пока идёт диалог, он умеет в фоне вызывать инструменты и загружать данные: в демонстрации аватар регистрирует гостя в отеле, не прерывая разговор.
Компании могут выбрать готового персонажа из библиотеки или создать собственного по качественному референсному изображению. Создание своих аватаров пока доступно только корпоративным клиентам по приглашению.
Защиты
Всё видео и аудио, которое создают продукты Google с ИИ, помечается невидимым водяным знаком SynthID, чтобы сгенерированный контент можно было распознать. Подробности о безопасности компания вынесла в карточку модели.
Что пока неизвестно
В анонсе Google не указана цена и нет результатов тестов качества аватара. Неизвестно и то, когда функция появится за пределами Gemini Enterprise.
Источники
Читайте также

The Verge AI: Meta* и OpenAI готовят устройства с ИИ-агентами

TechCrunch AI: DoorDash запускает ИИ-агента для заказов через Apple Messages
