TGViewer
Плохой менеджер Артём Арюткин Плохой менеджер Артём Арюткин @badtechproject · 14.3K subscribers
Post #1885 4.89K
Давнееенько у нас не было обзоров книг.
И тут недавно ребята из издательства Питер подогнали мне чудесную книгу по System Design «нового поколения», то есть GenAI.
Книга - это попытка адаптировать классическое system design интервью под новую реальность GenAI: LLM-приложения, RAG-архитектуры, агенты, оценка качества и стоимость инференса. Полезно как структурированный чек-лист, но это скорее введение, чем глубокий инженерный разбор.
Хотя как менеджер я обожаю эту серию книг, она позволяет погрузиться во множество разных тем.

System Design для эпохи GenAI
Все привыкли к классическим вопросам на system design интервью:
- спроектируйте Twitter
- спроектируйте YouTube
- спроектируйте Uber
Но последние пару лет компании начали задавать другой тип задач:
спроектируйте AI-чат ассистента
спроектируйте RAG-поиск по документам
спроектируйте AI-копилота для разработчиков
И вот тут многие кандидаты ломаются.
Почему?
Потому что классическая архитектура (API + база + кэш) внезапно превращается в:
User → Gateway → Orchestrator → LLM → Retrieval → Vector DB → Tools → Evaluation
И вот именно эту новую архитектуру книга и пытается разобрать.

Основная идея книги
Авторы говорят простую вещь:
GenAI-системы - это не просто “вызов LLM API”.
Это полноценная распределённая система.

И в ней появляются новые архитектурные компоненты.
Например.
1. Retrieval (RAG)
LLM сам по себе туповат.
Он знает интернет до даты обучения.
Поэтому почти любая реальная система делает:
Query
→ Embedding
→ Vector search
→ Context
→ LLM
Книга разбирает:
как хранить embeddings
как масштабировать vector search
как строить pipeline retrieval

2. Оркестрация моделей
LLM редко работает один.
Обычно это:
Router
→ model A (cheap)
→ model B (smart)
→ tools
Причина банальная.
LLM дорогой.
Поэтому архитектура всегда балансирует:
качество vs стоимость vs latency

3. Оценка качества
Самая сложная часть GenAI-систем.
В классических сервисах есть метрики:
latency
error rate
throughput
А в LLM-системах появляется ад.
Например:
- hallucination rate
- factual accuracy
- grounding
- response quality
И это очень плохо измеряется.
Книга показывает базовые подходы:
LLM-as-judge
human evaluation
golden datasets

4. Стоимость
GenAI архитектура - это экономика.
Каждый запрос стоит денег.
Поэтому появляются решения:
кэширование ответов
prompt compression
routing моделей
batching
На интервью это любят спрашивать.

Что в книге хорошо
1️⃣ Хорошая структура для интервью
Если вам задают вопрос:
Спроектируйте AI-ассистента
книга дает простой фреймворк:
User interaction
Retrieval layer
LLM orchestration
Tools
Evaluation
Cost control
Это полезно.

2️⃣ Понятный чек-лист архитектуры
После книги начинаешь автоматически думать:
где embeddings?
где кэш?
где evaluation?
где rate limiting?

3️⃣ Актуальность
Большинство книг по system design написаны до эпохи LLM.
А здесь фокус именно на GenAI-архитектуре.

Где книга слабая

1️⃣ Мало глубины.
Например vector search объясняется очень поверхностно.
Нет разбора:
HNSW
IVF
ANN tradeoffs

2️⃣ Мало production-кейсов.
Реальные системы:
Copilot
Perplexity
ChatGPT
имеют гораздо более сложные пайплайны.

3️⃣ Почти нет темы агентов
А именно туда сейчас движется индустрия.

Если раньше system design интервью проверяло:
умеешь ли ты масштабировать сервис
то теперь проверяют:
умеешь ли ты проектировать AI-системы.
И там появляются новые вопросы:
как уменьшить hallucinations
как контролировать стоимость токенов
как строить RAG
как оценивать качество
И это новый слой архитектуры.

🔥 - если читал и зашло
❤️ - если забрал в бэклог
🦄 - если читал и не зашло
  • ❤ 63
  • 🔥 11
  • 👍 8
  • 🤔 2
  • 🦄 2
  • 👏 1
More from @badtechproject
  1. Sep 23, 2026Post #2197
  2. Sep 23, 2026Сервис, который держится на конкретных людях, это не сервис 😁 Это ручное управление. Коро…
  3. Sep 23, 2026Как правильно уходить в отпуск и возвращаться из него, чтобы прямо по кайфу (Часть 2) Вот…
  4. Sep 22, 2026Ааааааа
  5. Sep 21, 2026Купили всем AI. Теперь быстрее ждём согласования Короче, McKinsey выпустили статью про «на…
  6. Sep 21, 2026Вы уверены наверняка, что будет с инфраструктурой, если завтра трафик вырастет в 5 раз? Се…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →