Gemini 3.8 TTS: создание собственных голосов и синтез на 100+ языках

Google DeepMind

аудио официальный 1 ист. ~1 мин

Google выпустила Gemini 3.8 Flash TTS и Flash-Lite TTS (23 сентября) — самые выразительные на данный момент модели генерации аудио: создание голосов с нуля, репликация голоса по коротким сэмплам и построчное управление исполнением на 100+ языках. Защитные механизмы включают проверку согласия, водяные знаки SynthID и учётные данные C2PA.

Почему это важно

Frontier TTS с гарантиями согласия и провенанса, доступный в публичном Gemini API.

Важность: 3/5

Заметный мажорный релиз во флагманской аудиолинейке Google

Источники

официальный Gemini 3.8 text-to-speech says hello