Google добавила говорящие аватары в Gemini Enterprise
В корпоративных чат-ботах обычно раздражает не только роботизированный голос, но и пауза, пока агент ищет ответ. Google пытается закрыть обе проблемы одним продуктом: Gemini 3.8 Live with Live Avatar добавляет к голосовому диалогу потоковый видеоаватар. Функция уже доступна в Gemini Enterprise.
По описанию Google, модель одновременно обрабатывает звук и изображение, а затем отвечает голосом с синхронизированными движениями губ и мимикой. Во время разговора агент может вызывать инструменты и получать данные в фоне — например, проверять информацию при заселении гостя, не обрывая диалог. Это не означает, что агент стал надёжнее: видео делает ожидание менее заметным, но качество ответа по-прежнему зависит от данных и подключённых систем.
Не просто «лицо» для бота
Google заявляет поддержку 97 языков: при смене языка в ходе беседы должны меняться и синхронизация губ, и выражение лица. Для компаний это может быть важнее самого эффекта аватара — один сценарий поддержки можно адаптировать для нескольких рынков без отдельной видеозаписи на каждый язык.
Есть и брендинговый слой. Помимо готовой библиотеки персонажей, разработчик может сделать аватар по качественному референсному изображению, сохранив внешность или стиль бренда. Но именно эта часть пока доступна только через корпоративный allowlist, то есть не каждому пользователю Enterprise.
Где проходит граница
Google пишет, что результат помечается SynthID — цифровым водяным знаком для AI-контента. Это полезный сигнал, но не замена ясному раскрытию: пользователю сервиса всё равно стоит сразу понимать, что перед ним не живой сотрудник.
Самый правдоподобный сценарий для Live Avatar — не общий чат с «лицом», а короткие, повторяемые диалоги: первичная поддержка, объяснение услуги, регистрация или обучение. Там естественная очередность реплик может снизить трение. В сложном споре красивый аватар рискует лишь сделать уверенную ошибку убедительнее.













