TGViewer
Машинное обучение RU Машинное обучение RU @machinelearning_ru · 18.2K subscribers
Post #3314 1.96K
SenseNova-U1: мультимодальная модель без привычной «склейки» зрения и языка

SenseNova-U1 вышла на ModelScope под Apache 2.0. Это native multimodal модель, которая объединяет понимание и генерацию в одной архитектуре.

Внутри NEO-Unify: без visual encoder и без VAE. Вместо отдельной обработки картинки и текста модель работает с языком и визуальными данными как с единым end-to-end представлением.

На практике одна модель закрывает сразу несколько задач: text-to-image, редактирование изображений, interleaved generation и visual QA.

Заявлены две версии: 8B-MoT dense и A3B-MoT MoE. По словам разработчиков, SenseNova-U1 показывает SOTA на open-source бенчмарках для понимания и генерации.


https://modelscope.cn/models/SenseNova/SenseNova-U1
  • ❤ 3
  • 👍 1
  • 🔥 1
More from @machinelearning_ru
  1. Sep 26, 2026Жиза
  2. Sep 24, 2026🚨 ИИ-агенты пытались взломать сайты, выполняя обычные задачи по поиску данных Исследовате…
  3. Sep 24, 2026Avito DS Meetup: RL, AI-агенты и BidCorrection 🚀 🔸 Булат Шарипов расскажет, как в Авито…
  4. Sep 23, 2026Невыполнимая задача заставляет ИИ чаще искать обходные пути В системной карте Claude Opus…
  5. Sep 23, 2026Протестируй своё решение на задаче и данных от ПАО «Интер РАО» На хакатоне ты создашь умно…
  6. Sep 22, 2026Теренс Тао призвал замедлить гонку ИИ в математике «Мы можем позволить себе двигаться медл…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →