Suno добавила функцию Speech: нейросеть озвучивает текст и пишет музыку к нему

Suno, которую знают прежде всего как нейросеть для генерации музыки, добавляет новую функцию Speech. Она создаёт произносимый текст и подходящую фоновую музыку сразу как единую аудиодорожку.
Пользователь вводит идею или готовый текст и описывает, каким должен быть голос и в каком стиле музыка. После этого модель генерирует и голос, и звуковое сопровождение.
По словам Джека Броди, руководителя продукта Suno, компания месяц тестировала Speech на небольшой группе пользователей. Suno говорит, что функцию можно использовать для стихов, медитаций и сказок на ночь. При этом бета-версия ещё работает с ошибками: например, британский акцент иногда звучит как австралийский.
Suno не сообщала, как обучала модель. Это происходит на фоне критики генераторов музыки из-за возможных нарушений авторских прав. Крупные звукозаписывающие лейблы уже подали на Suno в суд, а мюнхенский суд недавно вынес решение не в пользу стартапа, отвергнув добросовестное использование (fair use) как оправдание применения защищённых авторским правом данных.
Ключевые факты
- Suno добавляет функцию Speech: речь и подходящая фоновая музыка создаются вместе в одной аудиодорожке.
- Пользователь вводит идею или текст и описывает желаемый голос и музыкальный стиль.
- Suno предлагает использовать функцию для стихов, медитаций и сказок на ночь; руководитель продукта Джек Броди сообщил о месячном тесте на небольшой группе.
- Бета-версия ещё с ошибками: британский акцент иногда звучит как австралийский.
- Suno не раскрывала, как обучала модель; лейблы уже судятся с компанией, а мюнхенский суд недавно отверг fair use как довод.
Почему это важно
Suno известна как сервис генерации музыки, и Speech расширяет его на озвучку: голос и музыка делаются одной моделью и сразу складываются в одну дорожку. Это шаг от чисто музыкального инструмента к более широкому генератору аудио.
Кому это важно
Тем, кто делает короткое аудио с текстом и фоном: стихи, медитации, сказки на ночь, именно эти сценарии называет Suno. Также интересно следить за рынком генераторов звука и спорами об авторском праве вокруг них.
Как это применить
Опишите идею или вставьте готовый текст, затем задайте желаемый голос и стиль музыки, модель создаст дорожку целиком. Сроки выхода, цены и условия доступа к Speech в источнике не названы.
Можно ли доверять
Описание функции опирается на заявления самой Suno и её руководителя продукта Джека Броди; независимых проверок в материале нет. Об ограничениях известно только то, что бета ещё с ошибками.
Риски и подводные камни
Функция в бета-версии: британский акцент иногда звучит как австралийский. Suno не сообщала, как обучала модель, а крупные лейблы уже судились с компанией; мюнхенский суд недавно отверг fair use как оправдание использования защищённых данных. Относится ли это решение именно к Speech, в источнике не сказано.