TGViewer
Lamoda Tech Lamoda Tech @latech · 11K subscribers
Post #2047 2.18K
🤩 Как масштабировать LLM-разметку и не перегрузить API?

Наши дата-инженеры задали себе этот вопрос, когда начали масштабировать LLM-разметку на большие объемы данных.

Так появился llm_markup — универсальный Spark-инструмент, который берет на себя батчинг, параллельные запросы к LLM API, контроль нагрузки, повторы и валидацию ответов.


Инженер по работе с большими данными Дима Иванов рассказывает о том, как это устроено — на примере оценки качества поиска и классификации отзывов.

Но llm_markup этим не ограничивается и подходит для разных задач массовой LLM-обработки. Главное, чтобы их можно было описать источником данных, промптом и форматом ответа.

⏏️ Листайте карточки ⏏️ и погружайтесь в подробный разбор архитектуры со всеми нюансами — mapInPandas, rate limiting, JSONL и structured-режимы для стабильной работы в продакшене.

Читать на Хабре

✉️ Lamoda Tech

#LaTech_habr
  • 🔥 9
  • 👍 4
More from @latech
  1. Sep 18, 2026👩‍💻 Open Call: ищем спикеров на Go-конференцию 17 октября проводим Go Weekend в офисе La…
  2. Sep 17, 2026Ученые тренируют муху-дрозофилу проходить Doom и парковаться 🪰 Мы тоже решаем непростые з…
  3. Sep 14, 2026День программиста был вчера, а мы уже загрузили воспоминания о нем в долгосрочную память.…
  4. Sep 12, 2026Чем заняться в субботу? Вспомнить про свои хобби Это новые истории от коллег в параллельно…
  5. Sep 11, 2026Lamoda Tech pinned a photo
  6. Sep 11, 2026А вот и конкурс 🍢 Видим, что новый мерч понравился, а День программиста — повод дарить по…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →