💡 State of AI: Откуда мы пришли, кто мы и куда мы идём?
– Страница мероприятия
– 16 марта, 14:00 – 17:30
– ПОМИ РАН, наб. реки Фонтанки, 27, Санкт-Петербург
– Пожалуйста, не забудьте зарегистрироваться — это необходимое условие посещения ПОМИ РАН.
⭐️ О лекторе
Сергей Николенко — учёный, преподаватель и практик в области машинного обучения и информатики в целом. Доктор физико-математических наук, сотрудник ПОМИ РАН, преподаватель в СПбГУ, Harbour Space University, ИТМО и НИУ ВШЭ, Head of AI в компании Synthesis AI, автор более 200 научных публикаций и нескольких книг, в том числе бестселлера «Глубокое обучение» (Питер, 2018), монографии «Synthetic Data for Deep Learning» (Springer, 2021) и прямо сейчас появляющейся в продаже книги «Машинное обучение: Основы» (Питер, 2025). Сергей ведёт исследования в разных областях, от улучшения больших языковых моделей до анализа алгоритмов и теоретической информатики, применяет машинное обучение в реальных проектах, пишет посты и книги, ведет телеграм-канал «Sinекура» (@sinecor), а также стал двукратным чемпионом мира по «Что? Где? Когда?».
📢 Анонс
Уже два года мы живём в эпоху больших языковых моделей (large language models, LLM). За пределы академического сообщества эти новости вышли после появления ChatGPT от OpenAI, а затем появилось много разных моделей, либо созданных на основе ChatGPT, либо продолжающих и развивающих её идеи. Например, главные новости последних месяцев — это большие рассуждающие модели (large reasoning models, LRM), сначала появившиеся у OpenAI в виде семейства o1, а затем внедрённые практически во все ведущие LLM, в том числе [полу]открытые. Начиная с весны 2023 года, буквально каждую неделю появляются новости, которые раньше считались бы революционными, и скорость прогресса никак не хочет уменьшаться.
В первой части я постараюсь рассказать о том, как искусственный интеллект дошёл до такой жизни. Мы поговорим о том, что такое нейросети в целом, как произошла сначала революция глубокого обучения, потом внутри неё революция трансформеров, а потом, внутри неё, — революция больших языковых моделей. Обсудим самые последние новости и сформулируем несколько направлений, которые прямо сейчас являются предметом активных исследований. DeepSeek-R1 тоже обсудим, разумеется. Кое-какие технические детали, возможно, рассказать будет уместно, но я постараюсь сделать рассказ максимально доступным для непрофессионалов.
