Gemini теперь умеет клонировать голос и играть роли, как актер
Обновление искусственного интеллекта от Google добавляет более 2000 голосов, сцены с двумя спикерами и улучшенное управление подачей.

Компания Google представила крупное обновление для своей системы искусственного интеллекта Gemini. Новая функция позволяет пользователям клонировать собственный голос и исполнять сценарии с интонациями профессионального актера.
Апдейт добавляет в арсенал платформы более 2000 новых голосов, а также предоставляет более точные инструменты управления подачей речи. Теперь искусственный интеллект способен не просто зачитывать текст, но и передавать эмоции в зависимости от контекста сцены.
Кроме того, в систему были внедрены сцены с двумя спикерами. Это нововведение позволяет создавать диалоги между несколькими персонажами, делая звучание более естественным и динамичным.
Для узбе키ستانских создателей контента и IT-специалистов такие технологии открывают новые горизонты в производстве подкастов, локализации видео и создании аудиокниг. Автоматизация озвучки существенно сэкономит время и ресурсы для независимых студий.
Эксперты отмечают, что подобные инструменты продолжат стремительно развиваться, стирая грань между синтезированной и живой человеческой речью во многих сферах медиаиндустрии.



