Вчера выложили запись нового релиза CH, отсмотрел, рассказываю, что показалось интересным с точки зрения BI или Data поставок
1) Консистентность SELECT с подзапросами, если в таблицу постоянно что-то льется, snapshot теперь один на все подзапросы одной и той же таблицы.
2) Запись в Merge движок! ооо, прям интересно, как это может быть использовано, всегда воспринимал Merge только как SELECT-вьюху. Типа можно в какой-то момент стопнуть одну таблицу и начать заливать в следующую
Merge(db,'table_\d+$',auto)
-- будет лить в последнюю табличку по порядку
3) Performance 1. Для Distributed табличек - поменяли место сериализации данных на машинах - стали параллелить сериализацию -40% к времени выполнения!
4) Performance 2. Добавили управление количеством запросов в настройках WORKLOAD, то есть можно еще лучше потюнить запросы, которые идут к DWH источникам, например и к Аналитическим, в зависимости от важности
5) Performance 3. Проверка и использование нескольких проекций, а не одной. Не тестировал еще на своем кейсе, но у меня была проблема в разных проекциях: group by 1, group by 1,2 group by 1,2,3 и в случае выбора 1 и/или 2 бралась все равно проекция 1,2,3 и это прям было больно
6) Performance 4. ch dig - офигенская тула по мониторингу CH, там есть раздел Slow Queries 😈 и Flame Graph для того, чтобы понять, где именно в Query самый медленный кусок!
7) Nice. Новая Веб мордочка к серверу приятная, монитор, WebSQL UI, Дока, Удобно быстро что-то без SQL Manager пописать и посмотреть состояние сервера в целом =)
