BTC $84 115 +0.4%ETH $2 690 +0.2%SOL $121 +0.4%TON $1,53 +7.8%BTC $84 115 +0.4%ETH $2 690 +0.2%SOL $121 +0.4%TON $1,53 +7.8%
ии3DNews

Google выпустила модели синтеза речи Gemini 3.8 Flash TTS с клонированием голоса

Google выпустила модели синтеза речи Gemini 3.8 Flash TTS с клонированием голоса

Для разработчиков игр, подкастов и аудиокниг это означает отказ от библиотек готовых голосов в пользу генерации собственного тембра и управления подачей отдельных реплик. Детали о цене, доступности и правилах использования клонированных голосов Google не раскрыла.

Google представила две модели синтеза речи — Gemini 3.8 Flash TTS и Gemini 3.8 Flash-Lite TTS. Обе генерируют голос под задачу, а не выбирают вариант из фиксированного набора.

По заявлению компании, модели позволяют создавать собственные голоса, управлять исполнением отдельных реплик и собирать выразительные диалоги. Применение — игры, подкасты, аудиокниги и другие проекты, где нужна озвучка.

Дата запуска, стоимость и правила работы с клонированными голосами Google не раскрыла.

Источник

3DNews · права на исходный материал принадлежат автору.

Материал носит информационный характер и не является индивидуальной инвестиционной рекомендацией. Операции с криптовалютами связаны с риском полной потери вложенных средств. Подробнее — «Отказ от ответственности».

Bittalk в Telegram

Разборы событий, итоги дня и то, что двигает рынок. Без сигналов и обещаний — только факты и что они значат.

Читать в Telegram →

По теме