TGViewer
Сибирские Нейросети: Речевая аналитика и малые безопасные языковые модели для бизнеса Сибирские Нейросети: Речевая аналитика и малые безопасные языковые модели для бизнеса @dialoger_tech · 256 subscribers
Post #179 287

Forwarded from Ivan Bondarenko

Всем привет! Кажется, что сегодня - день релизов, и я решил тоже сделать релиз, раз уж все делают 😊

Правда, я - не МТС.ИИ и не Т-банк, поэтому мой релиз будет маленьким, на 1.5B 😅 Ну и в духе общей моды, на базе Qwen2.5: https://huggingface.co/bond005/meno-tiny-0.1

"Менон" - в честь сократического диалога Платона, в котором тот постулирует "знание через припоминание". Соответственно, основная цель Meno-Tiny - быть частью RAG-пайплайна, решая такие задачи, как ответы на вопросы по релевантным документам, абстрактивная саммаризация, разрешение анафоры в пользовательских вопросах (чтобы засовывать в ретривер текст вопроса с уже разрешённой анафорой), определение токсичности, детоксификация и другие задачи. Даже для исправления ошибок распознавания речи, включая восстановление пунктуации и капитализации, можно применять Meno-Tiny (правда, в режиме few-shot prompting).

На MERA сейчас Meno-Tiny-0.1 занимает 38-е место из 62, при этом в своём "размерном классе" дешёвых моделей-малышей на 1.5B он, кажется, лучший. На самых интересных для меня задачах он получше, чем в среднем: так, на MultiQ он занимает 25-е место из 62, а на RWSD - 17-е место (но я всё делал честно, никаких секретных техник типа "train on test set is all you need" я не использовал, и данные бенчмарка в мой трейн не протекали).

Кстати, об обучении. Обучался Meno-Tiny-0.1 на специальном русскоязычном инструкционном датасете, частично составленном путём дистилляции из Гигачата и из Qwen2.5-14B, частично на основе перевода англоязычных датасетов с фильтрацией по галлюцинациям машинного переводчика, частично - на основе собственных данных и датасетов из специализированных NLP-задач (таких, как детекция парафраза, упрощение текстов, исправление ошибок распознавания речи моделью Wav2Vec2-Large-Ru-Golos на синтетических данных и т.п.). Для файнтюнинга использовался curriculum learning по сложности в духе https://arxiv.org/html/2405.07490v1

Надеюсь, что Meno-Tiny-0.1 окажется кому-нибудь полезен 😊
huggingface.co bond005/meno-tiny-0.1 · Hugging Face We’re on a journey to advance and democratize artificial intelligence through open source and open science.
  • 🔥 12
  • ❤ 4
More from @dialoger_tech
  1. Jul 1, 2026🚀 Мы на Hugging Face! Друзья, мы завели официальную страничку нашей компании Siberian Neu…
  2. May 8, 2026Интересная статья про победу наших коллег под руководством Ивана Бондаренко на IBM-овском…
  3. Mar 11, 2026💬 Встреча 💬 Тема: Почему ChatGPT ошибается? Галлюцинации генеративных моделей языка и ме…
  4. Feb 24, 2026✍️Локальный AI-ассистент Василиса — работает даже на парковке! 😱 Знаете этот страх — загр…
  5. Feb 23, 2026✍️🚀 Встречайте asr_eval: наш новый открытый инструментарий для оценки и сравнения ASR-мод…
  6. Dec 25, 2025🎉 Год прорыва: «Сибирские нейросети» в топе мировой науки! Подводим итоги 2025 года: наша…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →