Новость · Глобальное

Gemini 3.8 TTS позволяет задавать голос и манеру речи текстом

Google представила Flash TTS и Flash-Lite TTS для озвучивания, диалогов и голосовых приложений.

tay · 24 сентября 2026 г. в 16:00
Студийный микрофон с поп-фильтром; тематическое фото к новости о синтезе речи
Galak76 / Wikimedia Commons; CC BY-SA 3.0. http://creativecommons.org/licenses/by-sa/3.0/ Показ без изменений. Тематическая иллюстрация. Студийный микрофон с поп-фильтром; тематическое фото к новости о синтезе речи. · Источник изображения ↗

Новые модели синтеза речи Gemini 3.8 позволяют управлять темпом, эмоциональной подачей и произношением с помощью инструкций. Flash TTS ориентирована на создание голосов и детальную режиссуру, а Flash-Lite TTS — на массовую генерацию с меньшими затратами.

Google заявляет поддержку более ста языков и диалектов, библиотеку свыше двух тысяч готовых голосов и работу со сценами для двух собеседников. Пользователь может описывать характер голоса и задавать подачу отдельных реплик.

Воспроизведение голосового профиля по образцу предусмотрено для собственного голоса либо голоса, на использование которого есть права. Компания указывает проверку согласия и маркировку синтетического звука.

Что пока неизвестно

Качество и доступность зависят от языка и продукта. Клонирование голоса не отменяет необходимости получить разрешение его владельца.

Источники

  1. Официальный блогОфициальное сообщение · Первоисточник
Источник не открывается?

Оригинальная страница может быть временно недоступна. Попробуйте открыть её позже; название и дата источника сохранены выше.

Сохранить · Настроить