Google представила Gemini 3.8 Live с говорящим аватаром

Google выпустила модель Gemini 3.8 Live, которая принимает голос, изображение, видео и текст, а отвечает через анимированного персонажа с синхронизацией губ, мимикой и голосом. Аватар встроен в саму разговорную модель, а не приделан к чат-боту сбоку. Это меняет то, как выглядят ИИ-ассистенты: разговор получает лицо, но и следить за таким собеседником сложнее — видео и голос требуют больше данных и вычислительных ресурсов.
Google представила Gemini 3.8 Live with Live Avatar — модель, которая принимает на вход голос, изображение, видео и текст, а отвечает через анимированного персонажа. У аватара синхронизация губ, мимика и голос.
Это не отдельный генератор говорящих голов, подключённый к чат-боту. Аватар встроен непосредственно в разговорную модель: он может видеть собеседника, слушать его, отвечать и обращаться к внешним сервисам во время разговора.
Хабр ИИ · права на исходный материал принадлежат автору.
Материал носит информационный характер и не является индивидуальной инвестиционной рекомендацией. Операции с криптовалютами связаны с риском полной потери вложенных средств. Подробнее — «Отказ от ответственности».
Разборы событий, итоги дня и то, что двигает рынок. Без сигналов и обещаний — только факты и что они значат.
Читать в Telegram →По теме
- ▪Россия и Белоруссия собрали опытный литограф для чипов 130 нмiXBT · 28 сентября
- ▪Сенат Австралии вызвал гендиректоров OpenAI и Anthropic на слушания о взломе ИИ-агентом базы здравоохранения3DNews · 28 сентября
- ▪NVIDIA представила платформу контроля ИИ-агентов на чипе BlueField-4Data Secrets TG · 28 сентября
- ▪Хук PreToolUse в Claude Code пропускает ключи в коммитах вдвое чаще среднегоХабр ИИ · 28 сентября