Google · Искусственный интеллект · Gemini · AI аватары · Технологии · Новости IT24 сентября в 23:32 · 3 мин

Лицо ИИ: Google представил функцию Live Avatar для модели Gemini 3.8

Корпорация Google обновила свою экосистему искусственного интеллекта, внедрив в модель Gemini 3.8 Live технологию «живого аватара». Это обновление позволяет пользователям не только вести диалог с нейросетью в режиме реального времени, но и видеть, как анимированный персонаж реагирует на речь синхронизацией губ и мимикой. Согласно официальным данным, функция поддерживает 97 языков без потери качества видео, однако на текущем этапе она доступна исключительно корпоративным клиентам пакета Gemini Enterprise.

# Google наделяет AI лицом: новая функция Live Avatar

Технологический гигант Google продолжает трансформировать взаимодействие пользователей со своими языковыми моделями. Недавно анонсированная модель Gemini 3.8 Live, способная обрабатывать визуальные данные в режиме, близком к реальному времени, получила новое измерение: теперь она имеет «лицо». Новая функция, названная «Live Avatar» (Живой аватар), преобразует текстовые ответы модели в видеоряд, где цифровой персонаж не только произносит слова, но и демонстрирует соответствующую интонацию.

Синхронизация речи и выражения лица

В отличие от стандартных текстовых чатов, «Live Avatar» предоставляет визуальную обратную связь. Компания демонстрирует, что аватар может выполнять жесткую синхронизацию губ (lip-sync) и выражать различные эмоции в зависимости от контекста разговора. Google утверждает, что система способна переходить между 97 поддерживаемыми языками, сохраняя стабильность видео и избегая визуального расхождения (visual drift), когда движения губ не совпадают с произносимыми звуками.

Для иллюстрации возможностей продукта были опубликованы видеоролики, где один и тот же аватар безупречно коммуницирует на английском и японском языках. В демонстрациях также показано, что нейросеть может извлекать актуальную информацию и отображать её прямо на экране во время беседы, создавая эффект присутствия собеседника, который одновременно является цифровым агентом.

*«Live Avatar может синхронизировать губы и показывать различные мимику во время разговора»,* — отмечают разработчики.

Доступность и кастомизация

Важно подчеркнуть, что данная функция находится на стадии ограниченного развертывания. На текущий момент технология «Live Avatar» доступна только заказчикам корпоративного тарифа Gemini Enterprise. Это решение позиционируется как инструмент для бизнес-коммуникации, где визуальная составляющая взаимодействия с ИИ может играть ключевую роль в презентациях, обучении персонала или поддержке клиентов.

Google предлагает два пути интеграции: компания предоставляет библиотеку предустановленных аватаров, которые клиенты могут выбрать из каталога, но также оставляет возможность организациям создавать собственных уникальных цифровых представителей. Такой подход позволяет брендам сохранять свою идентичность даже в цифровой среде, где аватар служит лицом компании.

Безопасность и атрибуция

Как и в случае с другими продуктами компании, безопасность и этичность генерации контента остаются приоритетными. Весь вывод от «Live Avatar» снабжается невидимым водяным знаком SynthID. Эта технология позволяет различать синтезируемый контент от реальных медиафайлов, защищая авторские права и предотвращая дезинформацию. Кроме того, Google заявляет о внедрении мер защиты, призванных «уважать идентичность» пользователей и третьих лиц, что является обязательным условием для масштабирования подобных технологий в открытых экосистемах.

Презентация обновления «Live Avatar» следует за анонсом самой модели Gemini 3.8 Live, разработанной для работы с мультимодальными данными. Внедрение визуального компонента свидетельствует о том, что разработчики стремятся не просто улучшить функциональность, но и сделать взаимодействие с ИИ более естественным и человеко-ориентированным. Для широкой аудитории эта функция станет доступна в будущем, но пока что это привилегия бизнес-клиентов, готовых тестировать границы возможностей современной нейросетевой графики.

Первоисточники

The Verge AI ↗
← Вернуться в эфир