TGViewer
Big Data AI Big Data AI @bigdatai · 18.2K subscribers
Post #1410 1.65K
В открытый доступ выложили и обновили RuModernBERT — модель от VK для обработки естественного русского языка. Доступны две версии: 150M и 35M. Обучали на 2 триллионах токенов данных — брали всё: от классической литературы до соцсетей и документации.

Она понимает длинные тексты целиком, без разбиения на фрагменты и работает локально, без внешних API, что снижает нагрузку на инфраструктуру. Инженеры могут использовать ее для задач в области обработки текста, в том числе для извлечения информации, анализа тональности, поиска и ранжирования в приложениях и сервисах. А пользователи, таким образом смогут быстрее находить информацию, документы, видео или товары.

По скорости работы обходит аналоги — особенно на больших текстах (в 2-3 раза быстрее) и при запуске на устройствах (плюс 10-20% к скорости). В тестах по русскому языку показала топовые результаты.

Доступна на Hugging Face — там же лежат обновлённые USER/USER2 для группировки и поиска похожей информации.
  • ❤ 4
  • 👍 3
  • 🗿 2
  • 🔥 1
More from @bigdatai
  1. Oct 2, 2026ИИ Speculative decoding: зачем большой модели черновик от маленькой? Наруто пишет вперёд ч…
  2. Oct 2, 2026🚨 Anthropic начала жёстче блокировать доступ к Claude из Гонконга. Пользователи, которые…
  3. Oct 1, 2026OpenAI раскрыла масштабную попытку вытащить скрытые рассуждения своих моделей. След ведёт…
  4. Sep 30, 2026🚨 Claude-Red: библиотека навыков для пентестов с Claude. В репозитории собраны файлы SKIL…
  5. Sep 30, 2026🖥 Примеры кода на Python 2026: лучшие практики, разбор и задачи с решениями Python пример…
  6. Sep 29, 2026🚨 Anthropic в документах для инвесторов прямо предупреждает о рисках собственных ИИ-модел…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →