TGViewer
Data Day Data Day @dataday_official · 1.05K subscribers
Post #99 485
Как ускорить процессы вокруг моделей принятия решения?

Об этом на Fintech Data Day рассказал Игорь Вахламов, управляющий директор Газпромбанка.

Зачем ускорять процессы?
- Оставаться конкурентоспособными и успевать за рынком.
- Быстрее экспериментировать и внедрять изменения.
- Экономить ключевые ресурсы.

За счет чего ускорять?
- Быстрая финансовая оценка эффектов.
- Автоматизация подготовки ТЗ и данных.
- Автокалибровка моделей, подбор сегментов и cut-off.

Почему нужны регулярные обновления
Модели (особенно градиентный бустинг) деградируют: около −0,5 п.п. метрики в месяц и через 4–6 месяцев заметно теряют пригодность из‑за data drift, concept drift и изменений среды.

Как оценить ущерб
Используем финансовую оценку изменения метрики. Имея работающую стратегию и экономику успешных/неуспешных кейсов, можно:
- сгенерировать бутстреп-выборки для варьирования метрик;
- для каждой построить зависимость средней прибыли от метрики и управляемых факторов.

Коэффициент при метрике даст денежный эффект одного пункта. Если он значим, идем дальше.

Постановка задачи
Готовим дизайн-документы, ТЗ, согласования с бизнесом. LLM помогают формулировать цели, источники, таргеты, требования к мониторингу и пр.

Автоподготовка данных
1) Интеграция с источниками и автоматическое извлечение признаков.
2) Проверка качества/стабильности и рекомендации по улучшению.
3) Преобразование и передача данных в модель.

Автокалибровка моделей
- Поиск сегментов для калибровки.
- Выбор методов перехода и их настройка (важно для чувствительных к трендам рисковых моделей).
- Выбор и настройка самих методов калибровки.

Гибкий подбор сегментов
- конструируем искусственную величину, учитывающую и целевой признак, и выход модели, чтобы видеть, где модель сильнее/слабее.
- Обучаем, например, дерево решений на признаках, доступных для сегментации, и автоматически находим сегменты.

Подбор cut-off
- Вариант 1: отсекать максимум при риске не выше порога.
- Вариант 2: оптимизировать recall — найти заданную долю проблемных в отсеченном множестве.
- Вариант 3 (частый в рисках): максимизировать одобряемую популяцию при ограничении на риск.

Гибкая логика по сегментам
- В сегментах с лучшей работой модели — выше cut-off и жестче отсечение.
- В слабых — мягче пороги.
- При высокой доле целевого класса — можно ужесточать отсечение.

Итеративная настройка
- Для каждого сегмента подбираем коэффициент целевой метрики отсечения.

Эффект
- минус 3–5% отказов за счет математических методов ручной настройки.

Мониторинг после внедрения
- Автосбор данных.
- Автодиагностика аномалий и выбросов.
- Предсказательный мониторинг: прогноз индексов стабильности и эскалация только значимых отклонений.

"В будущем моделирования мы ожидаем: различные экосистемы данных, включая генеративные feature store’ы, проактивные дата-пайплайны для переобучения, песочницы для тестов; персонализированные движки (например, продуктовые трансформеры для адаптация предложений под поведение клиента, предсказание событий по жизненным изменениям клиента, а также движение в сторону больших моделей", - поделился в заключение прогнозами Игорь Вахламов.


17 сентября приглашаем вас на Scoring Day - будут обсуждаться не менее интересные темы!
  • 👍 3
  • ❤ 2
  • 🔥 2
  • 🤩 2
More from @dataday_official
  1. Sep 17, 2026🤖 Эпоха умной автоматизации: классический Airflow или AI для решения задач рисков? Автома…
  2. Sep 16, 2026‼️ Друзья, напоминаем: открыт прием заявок на питч-сессию «Теорема молодых» в рамках Форум…
  3. Sep 14, 2026Друзья, 22 сентября на Форуме риск-менеджеров, который проводит команда Data Day, будет ос…
  4. Sep 10, 2026Друзья, на форуме Scoring Day 2026 , который 23 сентября проводит команда Data Day, у разр…
  5. Sep 9, 2026Друзья, на сайте Scoring Day 2026, который проводит команда Data Day, опубликовали програм…
  6. Sep 8, 2026📊 Как использовать агрегированные данные БКИ для защиты розничного портфеля? Ни одно отде…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →