Всем привет!
На ближайшем reading group разберём статью HyCo2 — про гибридное сжатие контекста для LLM.
Обсудим:
- как совместить “мягкую память” и “жёсткий отбор фактов”, чтобы читать меньше токенов, но не терять качество
- почему не получается нормально учить end-to-end и зачем 3-стадийное обучение
- что показывают на QA бенчмарках и как метод ведёт себя при росте числа документов
Если хотите — кидайте вопросы заранее в комментарии 👇
А встречаемся уже завтра в 15:00 по МСК вот тут 👉 ссылка
Post #85
704

- ❤ 8
- 👍 6
- 🔥 3
- 👏 2