Google добавила Live Avatar в Gemini 3.8 Live для предприятий
Google 24 сентября представила Gemini 3.8 Live with Live Avatar — корпоративную функцию, которая дополняет диалоговую модель потоковым видео с визуальным персонажем. Компания открыла её в Gemini Enterprise и предлагает разработчикам подключение через API. Это отдельное расширение выпущенной неделей ранее Gemini 3.8 Live, а не новая базовая версия модели.
По описанию Google, Live Avatar одновременно обрабатывает визуальные и звуковые входные данные, а затем формирует аудио- и видеоответ почти в реальном времени. Компания заявляет о точной синхронизации речи с движением губ, естественной мимике и плавной передаче реплик. В качестве возможных корпоративных сценариев названы обслуживание клиентов и интерактивные пошаговые инструкции.
Аватар способен вызывать внешние инструменты и получать данные в фоновом режиме, не прекращая разговор. Google иллюстрирует эту возможность сценарием регистрации постояльца в гостинице: агент продолжает общение, пока необходимые операции выполняются асинхронно. Страница анонса не приводит измерений задержки и не уточняет перечень совместимых корпоративных инструментов.
Функция поддерживает переключение между 97 языками непосредственно во время разговора. Как утверждает Google, синхронизация речи, движений губ и выражений лица адаптируется при смене языка без ухудшения качества видео или визуального дрейфа. Независимые результаты испытаний этих характеристик в анонсе не представлены.
Организации могут использовать готовых персонажей с разными внешностью и голосом либо создавать собственного аватара по качественному референсному изображению. По заявлению Google, при анимации сохраняются сходство с образцом, фирменный стиль или идентичность персонажа. Создание пользовательских аватаров пока предоставляется только предприятиям, включённым в специальный список допуска.
Практический контекст: Практически запуск превращает Gemini 3.8 Live из преимущественно голосовой основы в компонент для виртуальных представителей бренда. Для внедрения особенно важны две границы: доступ ориентирован на Gemini Enterprise, а кастомизация внешности требует отдельного допуска. Кроме того, страница анонса не раскрывает цены, требования к инфраструктуре и количественные показатели задержки, поэтому сравнить решение с другими потоковыми аватарами по стоимости и скорости пока нельзя.
Google сообщает, что все создаваемые системой аудио- и видеоматериалы получают незаметную маркировку SynthID. По заявлению компании, водяной знак встраивается непосредственно в звук и видео, чтобы сгенерированный контент можно было распознать и снизить риск дезинформации или ошибочной атрибуции.
| Компонент | Что заявляет Google | Условие или ограничение |
|---|---|---|
| Диалог | Потоковые аудио- и видеоответы почти в реальном времени | Количественная задержка не указана |
| Языки | Переключение между 97 языками с адаптацией мимики и синхронизации губ | Независимые результаты испытаний не приведены |
| Инструменты | Асинхронные вызовы инструментов без остановки разговора | Список совместимых инструментов не указан |
| Аватары | Готовые персонажи и создание по референсному изображению | Собственные аватары доступны только по корпоративному списку допуска |
| Маркировка | SynthID в создаваемых аудио и видео | Предназначена для обнаружения ИИ-контента |
Источники
Дата события: 2026-09-24. Дата первоисточника: 2026-09-24.