Обзор собеседования с Neoflex
ВОПРОСЫ:
1. Что на каждом слое делают с данными? (опиши 3–4 глаголами: raw, staging, ODS, DDS, data mart)
2. Слой data mart — нормализован или нет?
3. Почему data mart денормализован? Что выигрываем?
4. С какими моделями данных сталкивался: звезда, снежинка, data vault?
5. Как косвенно определить по структуре таблицы (без данных, только атрибуты, типы, констрейнты) — это факт или измерение?
6. Почему в таблице фактов не должно быть 3–4–5 больших varchar-полей?
7. Перечисли 6 стандартных констрейнтов на атрибут
8. Перечисли все виды ключей (primary, foreign, unique, простой/составной, натуральный/суррогатный и др.)
9. Какой из перечисленных ключей не является идентификатором таблицы, в которой находится?
10. Какие подвиды суррогатных ключей знаешь?
11. В чём разница между индексами и партициями?
12. Каким образом ты проверял данные? Какие метрики data quality использовал?
13. Приходилось ли разрабатывать конкретные метрики качества данных? Какие?
Плюс была несложная задача на исправление ошибок в sql-запросе.
—
Собеседование было в июне, по зп готовы платить 200к (я думаю +30к можно выторговать).
it пингвин | data engineer 🐧
#собеседование #менти
Post #251
2.93K
- 🔥 12
- 👍 8
- ❤ 3
- ✍ 3