Google выпустил Gemini 3.8 Flash TTS: модели синтеза речи с настройкой и клонированием голоса
Озвучка и дубляж на любых языках становятся обычной функцией API.
Google добавил в API и AI Studio две модели — Gemini 3.8 Flash TTS и Flash-Lite TTS. Они позволяют создавать собственные голоса, воспроизводить существующие и массово генерировать многоязычное аудио, в том числе для дубляжа.
Источники 2