Собесов

Сценарий: персистить промежуточные данные в parquet — best practices

PythonOptimisation и big dataЛёгкаяMiddle

Условие

В аналитическом пайплайне «сырьё → очистка → агрегаты → витрина». На каждом шаге сохраняем промежуточное. Почему parquet, а не csv? Как правильно партиционировать?

Хочешь увидеть разбор?

Зарегистрируйся бесплатно — откроется развёрнутое решение этой задачи и ещё 4 на выбор.

Зарегистрироваться и увидеть разбор
Уже есть аккаунт? Войти