Корпорация Google представила генеративную нейросеть MusicLM, которая способна создавать музыку по текстовому описанию и по изображениям. Доступ к ней пока открывать не будут.
Новинка обучена на 280 тысячах часов музыки и может создавать треки в любых жанрах. Также нейросеть учитывать нюансы описания. К примеру, ей можно задать трек, который может вызвать «ощущение пребывания в космосе» или «основной саундтрек аркадной игры».
Нейросеть может основываться на существующих мелодиях, которые пользователь напевает, наигрывает или насвистывает. Кроме того, система воспринимать несколько последовательно написанных описаний, чтобы создать длинный трек.
Помимо этого, задание для MusicLM можно поставить, комбинируя изображение и подписи к нему, установить уровень опыта виртуального «музыканта» или сгенерировать звук определённого инструмента.
Наконец, система может создавать вокальные партии, но они зачастую не являются полноценными текстами, а лишь подобием.
Ранее сообщалось о системе Riffusion, которая может создавать музыку на основе изображений. Сама Riffusion базируется на Stable Diffusion, но при этом использует изображения в качестве основы для звуковых спектрограмм.
22 вылета, 30 часов в воздухе и пять прерванных взлетов: новейший российский Ил-114-300 успешно выдержал проверку экстремальной жарой
В Сеть до анонса утекли изображения Sony WH-1000XM4C — обновленной версии популярных наушников
Тонкий Vivo V80 Lite 5G с аккумулятором на 10 000 мАч и камерой 50 Мп показали на официальных изображениях
Из молекулярных слоев тоньше нанометра создали действующую электронику
Корпоративные SSD подорожали в 6,5 раза за год: накопитель на 30 ТБ теперь стоит как новый автомобиль
Не просто «Корова»: развертывание и боевая настройка MailCow в продакшене
Память DDR5 на 128 ГБ за $3400 сметают боты: на реальных покупателей приходится всего 9% трафика
Дата-центры SpaceX на орбите грозят появлением нового вида электронных отходов