Suno научился создавать речь вместе с музыкой

2 мин чтения 0
Suno научился создавать речь вместе с музыкой

Suno расширяет генератор музыки: теперь сервис умеет превращать сценарий или короткое описание в голосовую дорожку и одновременно добавлять к ней фоновую музыку.

Суть события

Функция Speech вышла в публичную бета-версию на сайте и в мобильных приложениях Suno. Это не просто озвучка текста: сервис позиционирует новую модель как инструмент, который создаёт голос и музыку в одной цельной аудиодорожке. Фоновую часть можно отключить, если нужен только чистый голос.

Для обычного пользователя это означает более короткий путь от идеи до готового аудиофрагмента. Сценарий для короткого ролика, стихотворение или энергичная мотивационная речь могут получить и диктора, и атмосферу в одном запросе.

Детали

В разделе Create нужно выбрать Speech. В простом режиме достаточно описать желаемый результат — например, голос пирата, который собирает команду. В расширенном режиме можно вставить собственный текст, выбрать пол голоса, стиль речи и степень вариативности генерации.

Продолжительность ограничена примерно восемью минутами. Suno предупреждает, что качество пока нестабильно: акцент может неожиданно измениться, а драматическая пауза — оказаться слишком драматичной. Поэтому результат стоит прослушивать перед публикацией, особенно если в нём есть имена, числа или важные инструкции.

Практическая ценность функции зависит от возможности быстро исправлять отдельные фрагменты, не перегенерируя всю дорожку. Пока такой контроль ограничен, автору может потребоваться несколько попыток, чтобы получить подходящий темп, тон и баланс музыки.

Контекст

Синтез речи давно предлагают DeepMind, Adobe и ElevenLabs. Отличие Suno — в тесной связке голоса с музыкальным сопровождением. Это делает функцию интересной для авторов коротких видео, подкастов, аудиопоздравлений и игровых сцен, которым раньше приходилось собирать речь и музыку в разных инструментах.

Одновременно запуск выглядит как попытка расширить применение сервиса за пределами музыкальных треков. Для пользователей это удобнее, но конкуренция в генерации голоса станет заметнее: важными окажутся не только естественность речи, но и контроль над результатом.

Что дальше

На старте Speech разумнее воспринимать как быстрый черновик, а не как замену профессиональной записи. Проверьте произношение, смысловые паузы и соответствие голоса задаче. Следить за развитием музыкальных генераторов можно на примере материала о том, как Google встроила Lyria 3.5 в Gemini: https://ai-digest.ru/google-vstroila-generator-muzyki-v-gemini-lyria-3-5-delaet-treki-pryamo-v-chate/

Материал был полезен?
AI-инструменты без границ

Получите доступ к нужному AI-сервису уже сегодня

ChatGPT, Claude, Gemini, MiniMax и агенты для кода — предложения проверенных продавцов по доступным ценам. Оплата российскими картами, через СБП или криптовалютой.

Проверенные продавцы Быстрая выдача Доступные цены
Прокрутить вверх