Google выпустила модели синтеза речи Gemini 3.8 Flash TTS с клонированием голоса

Для разработчиков игр, подкастов и аудиокниг это означает отказ от библиотек готовых голосов в пользу генерации собственного тембра и управления подачей отдельных реплик. Детали о цене, доступности и правилах использования клонированных голосов Google не раскрыла.
Google представила две модели синтеза речи — Gemini 3.8 Flash TTS и Gemini 3.8 Flash-Lite TTS. Обе генерируют голос под задачу, а не выбирают вариант из фиксированного набора.
По заявлению компании, модели позволяют создавать собственные голоса, управлять исполнением отдельных реплик и собирать выразительные диалоги. Применение — игры, подкасты, аудиокниги и другие проекты, где нужна озвучка.
Дата запуска, стоимость и правила работы с клонированными голосами Google не раскрыла.
3DNews · права на исходный материал принадлежат автору.
Материал носит информационный характер и не является индивидуальной инвестиционной рекомендацией. Операции с криптовалютами связаны с риском полной потери вложенных средств. Подробнее — «Отказ от ответственности».
Разборы событий, итоги дня и то, что двигает рынок. Без сигналов и обещаний — только факты и что они значат.
Читать в Telegram →По теме
- ▪Google запустит ИИ-сервер на орбиту для проверки работы TPU в космосе3DNews · 26 сентября
- ▪OpenAI приостановила обучение мощных моделей из-за утечки через DNSData Secrets TG · 26 сентября
- ▪Anthropic заявила об открытии Claude в геномных данных, учёные сомневаются в его значимости3DNews · 26 сентября
- ▪Физики из Anthropic получили девятипетлевую амплитуду в N=4 SYM с помощью ClaudeData Secrets TG · 26 сентября