Google представила Gemini 3.8 Flash TTS и более лёгкую Gemini 3.8 Flash-Lite TTS — самые выразительные модели синтеза речи в семействе Gemini Audio, пишет блог компании 23 сентября.

Flash TTS заточена под креатив: голоса с нуля через текстовые промпты, акцент, эмоции, построчная режиссура, длинные аудиокниги и сцены на двух спикеров. Flash-Lite — для массового дубляжа, контента и голосовых агентов. В библиотеке уже больше 2000 готовых голосов и поддержка более 100 языков и диалектов.

Репликация голоса требует записи согласия владельца; весь вывод помечается SynthID и C2PA. Модели доступны в Google AI Studio и Gemini API; Flash-Lite также катится в Google Vids. Репликация в AI Studio недоступна в ряде регионов, включая EEA, UK и Индию.