Polars явно движется в сторону out-of-core обработки.
🔥 Что реально важно
— Streaming
join_asof (с группировками)Если вы работаете с таймсериями — это закрывает давнюю боль.
Теперь можно джойнить огромные таблицы по времени без MemoryError.
👉 Новый менеджер памяти (spill-to-disk)
Если раньше всё упиралось в RAM — теперь Polars может аккуратно сбрасывать часть данных на диск.
Половина обновления — это перенос операций в streaming:
—
cov, corr, skew, kurtosis → теперь можно считать на больших данных—
strptime → тоже стримится— оптимизация
sort → меньше лишних операцийЕсли вы используете:
.lazy().collect(streaming=True)
— профит стал заметно выше.
Другие мелочи, которые экономят время:
—
.unnest() теперь работает без аргументов—
merge_sorted для уже отсортированных данных— более аккуратные дефолты при чтении файлов
На что обратить внимание:
— убирают
dataframe interchange → если Вы связывали разные библиотеки, проверьте пайплайн— исправили кучу багов (pivot, CSV, parquet-статистика и др.)
pip install -U polars
🔗 Ссылка на релиз
📍 Навигация: Вакансии • Задачи • Собесы
Библиотека питониста
#свежак
