Gemini 3.8 TTS: создание собственных голосов и синтез на 100+ языках
Google DeepMind
Google выпустила Gemini 3.8 Flash TTS и Flash-Lite TTS (23 сентября) — самые выразительные на данный момент модели генерации аудио: создание голосов с нуля, репликация голоса по коротким сэмплам и построчное управление исполнением на 100+ языках. Защитные механизмы включают проверку согласия, водяные знаки SynthID и учётные данные C2PA.
Почему это важно
Frontier TTS с гарантиями согласия и провенанса, доступный в публичном Gemini API.
Важность: 3/5
Заметный мажорный релиз во флагманской аудиолинейке Google
Источники
официальный
Gemini 3.8 text-to-speech says hello