До конца регистрации на хакатон остается 2 недели, поэтому мы решили собрать подборку интересных моделей, которые помогут решить задачу:
🔴DiffSinger — модель для высококачественного синтеза вокала с точной адаптацией под разные стили.
🔴Riffusion — библиотека для генерации музыки и аудио в реальном времени с использованием Stable Diffusion. Позволяет создавать аудиотреки на основе спектрограмм и поддерживает интеграции через API.
🔴Bark — модель от Suno для преобразования текста в аудио. Она генерирует реалистичную речь, музыку, шумы и звуковые эффекты, включая смех и плач.
А еще, мы объявляем конкурс на самую крутую тему для исследования! Пишите свои идеи в комментарии к этому посту и регистрируйтесь на хакатон до 1 ноября. Победитель получит эксклюзивную футболку XLabs AI ❤️
Кстати, если у вас все еще нет команды, ее можно найти в чате ✌️
Post #34
2.94K
- ❤ 3
- 🔥 3
- ❤🔥 1