📅 Когда: 20:00, 27 марта
🎙️ Ведущий: Олег Лариков
📍 Где: Москва, ЦДО «Моноид»
💰 Стоимость: бесплатно
Это регулярные встречи дискуссионной группы по ML, AI и technical safety. Мы ищем статьи, которые что-то значат для области, чтобы их обсудить и попытаться понять и их смысл, и их роль.
На этой неделе читаем:
1️⃣ Unmasking Clever Hans Predictors and Assessing What Machines Really Learn - о фундаментальных проблемах с оценкой стратегической глубины поведения интеллектуального агента: если он решил тестовую задачу, то какую задачу он решал?
2️⃣ How Should AI Safety Benchmarks Benchmark Safety? - набор практических замечаний о бенчмарках рисков. Как заявляют сами авторы,
We also introduce a checklist that can help researchers and practitioners develop robust and epistemologically sound safety benchmarks.
(чеклист действительно есть, приложение D)
Чтобы поучаствовать во встрече, нужно:
⭕️прочитать статьи,
⭕️прийти и обсудить прочитанное.
📍Адрес: Ломоносовский проспект, 25к3, по вопросам прохода на территорию пишите @MonoidAdmin