←

Gemini 3.8 Live добавляет почти реальное время видео с Live Avatar

Google DeepMind

модели/LLM офиц. + СМИ 2 ист. ~1 мин

Google DeepMind выпустила Gemini 3.8 Live с Live Avatar: в живые голосовые диалоги Gemini добавлено потоковое видео с низкой задержкой, так что модель слушает, видит и говорит через визуальную персону с липсинком. Адаптируется на 97 языках, поддерживает асинхронные вызовы инструментов во время диалога, поставляется в Gemini Enterprise с кастомными аватарами из референсного изображения; весь аудио- и видео-вывод маркируется SynthID.

Почему это важно

Превращает Gemini Live из голосового в полноценную аудио-видео персону — прямой ответ конкурирующим live-agent-решениям для клиентских корпоративных сценариев.

Важность: 3/5

Запуск флагманского продукта frontier-лаборатории (Gemini Live) с корпоративным развёртыванием

Источники