Как LLM справляются с математикой и алгоритмами? ⤵️
В субботу, 5 июля, CS Space устроил большой митап, чтобы разобраться, на что способны современные большие языковые модели в мире математики и алгоритмов. Участники послушали доклады:
〰️Сергей Николенко сделал обзор современного уровня математических способностей LLM с особым фокусом на рассуждающие модели.
〰️Фёдор Петров рассказал о том, как LLM решают задачи уровня Frontier Math и международных олимпиад, обсудил бенчмарки и различия между математической интуицией «белковых математиков» и нейросетей.
〰️Данил Сагунов вместе со слушателями проверил, как модели справляются с алгоритмическими задачами: от классических собеседований до продвинутых тем университетских курсов.
После этого слушатели сразились в командных соревнованиях, победители которых получили подписанный бестселлер «Машинное обучение: основы» от автора квиза, а также мерч и интересные подарки!
Вместе с Сергеем Николенко сыграли в квиз «Три модальности»:
✔️ угадывали алгоритмы по звуковым рядам,
✔️ определяли авторов математических рукописей,
✔️ решали ЧГК-сет на тему технологий.
Провели серию игр про пределы возможностей LLM:
✔️ Сложная задача для LLM — придумывали короткие вопросы, чтобы сломать модели;
✔️ Vibe Coding — заставляли LLM генерировать код для графического диктанта, идею предложили наши друзья из Pinely;
✔️ AI Safety — взламывали LLM-игру Gandalf, пробуя обойти защиту и вытащить скрытые ответы модели.
Делимся материалами:
〰️записи докладов, презентации и задания квиза появятся на странице мероприятия;
〰️результаты соревнований;
〰️фотографии с мероприятия.
Спасибо всем участникам за прекрасную атмосферу и Pinely за поддержку мероприятия!
Post #110
8.35K









- 🔥 47
- ❤ 20
- ⚡ 12