Google выпустил две модели синтеза речи Gemini 3.8 Flash TTS
Google запустил Gemini 3.8 Flash TTS и Gemini 3.8 Flash-Lite TTS — две новые модели синтеза речи в семействе Gemini Audio. Flash TTS предназначена для творческой работы с голосами персонажей в играх, аудиокнигах и подкастах. Flash-Lite TTS оптимизирована для массового производства контента с контролем над тоном и темпом речи.
Обе модели позволяют разработчикам управлять произношением построчно на естественном языке. Модели доступны через Gemini API и Google AI Studio; доступ только через API без открытых весов для самостоятельного развёртывания.
Источник: MarkTechPost
Новости этого рынка выходят у нас в телеграме первыми — @wikicompass.