Подписаться в Telegram
← Ко всей ленте

Google выпустил Gemini 3.8 Flash TTS: модели синтеза речи с настройкой и клонированием голоса

Озвучка и дубляж на любых языках становятся обычной функцией API.

Google добавил в API и AI Studio две модели — Gemini 3.8 Flash TTS и Flash-Lite TTS. Они позволяют создавать собственные голоса, воспроизводить существующие и массово генерировать многоязычное аудио, в том числе для дубляжа.

Источники 2