Мне
друг недавно рассказал про
Suno, это AI редактор для музыки. Я в 2016-2019 годах в России занимался hands-on voicetech / speech recognition & synthesis, и с тех времен ещё помню что LSTM могли генерировать какую-то музыку, помимо речи.
С тех времен много что произошло - в 2021 появился
tortoise-tts, который переформулировал задачу генерации аудио в next token prediction, в 2022 OpenAI релизнули
Whisper. Ну и 11Labs сейчас это лидер в области генерации речи с $200m+ ARR и оценкой $6.6B 😭
Вчера ночью я решил поиграться с Suno и был
сильно удивлен его возможностями. У меня дома стоит пианино от бывшей коллеги, на котором я иногда подбираю музыку, которую слышал в течение дня. Я не заканчивал музыкальную школу, и мои таланты ограничиваются хорошим слухом и немного пением. Я не играл сложные партии, и ненавижу нотный стан - мне проще подобрать что-то на слух. И мне всегда хотелось что-то типа AI ассистента, который продолжит играть то, что я начал, сам подберет акомпонимент, сделает вариации и тд.
В общем вчера где-то за полтора часа я написал вот этот трек из простой 15-секундной дорожки и много играясь с промптами из стилями 🙈
Мне нравится как вышло. Оказалось MIDI Suno не поддерживает и проще всего было записать на диктофон мою игру и использовать как референс для генерации. Я думаю и напеть тоже можно.
В общем такие дела, AI это не только про coding assistants но ещё и music assistants. А ещё подписывайтесь
на меня и поддержите начинающего музыканта!