Новый голос Gemini Text-to-Speech

24 подписчика

12+
12+

3 просмотра

24 дня назад

ПожаловатьсяНарушение авторских прав

24 подписчика

12+
12+

3 просмотра

24 дня назад

ПожаловатьсяНарушение авторских прав
12+
12+

3 просмотра

24 дня назад

Источник представляет собой анонс значительных улучшений в моделях преобразования текста в речь (Text-to-Speech, TTS) Gemini 2.5 Flash и Gemini 2.5 Pro от Google DeepMind. Основные нововведения сосредоточены на предоставлении разработчикам большего контроля над генерируемым звуком, включая улучшенную выразительность с более точным следованием стилевым запросам, контекстно-зависимое управление темпом, а также бесшовное воспроизведение диалогов с сохранением голосов персонажей в многоголосых сценариях. Эти обновленные модели заменяют предыдущие версии, выпущенные в мае, и предназначены для создания высококачественного контента, такого как аудиокниги и учебные модули. В анонсе также упоминается, что партнеры, например Wondercraft и Toonsutra, уже используют новые возможности TTS для создания реалистичных аудиопродуктов, подчеркивая повышенные многоязычные и мульти-спикерные возможности. Узнайте больше: https://blog.google/technology/developers/gemini-2-5-text-to-speech/ Подпишитесь на Viber канал автора: https://viber.page #Google #Gemini #Gemini3 #TTS #голос #ИИ #dev

Название:

Новый голос Gemini Text-to-Speech

Категория:

Разное