Gemini 3.8 TTS позволяет задавать голос и манеру речи текстом
Google представила Flash TTS и Flash-Lite TTS для озвучивания, диалогов и голосовых приложений.

Новые модели синтеза речи Gemini 3.8 позволяют управлять темпом, эмоциональной подачей и произношением с помощью инструкций. Flash TTS ориентирована на создание голосов и детальную режиссуру, а Flash-Lite TTS — на массовую генерацию с меньшими затратами.
Google заявляет поддержку более ста языков и диалектов, библиотеку свыше двух тысяч готовых голосов и работу со сценами для двух собеседников. Пользователь может описывать характер голоса и задавать подачу отдельных реплик.
Воспроизведение голосового профиля по образцу предусмотрено для собственного голоса либо голоса, на использование которого есть права. Компания указывает проверку согласия и маркировку синтетического звука.
Что пока неизвестно
Качество и доступность зависят от языка и продукта. Клонирование голоса не отменяет необходимости получить разрешение его владельца.
Источники
Источник не открывается?
Оригинальная страница может быть временно недоступна. Попробуйте открыть её позже; название и дата источника сохранены выше.