Каталог задач
1005 задач. Страница 12 из 21. Авторские задачи для подготовки к собеседованиям аналитиков с разборами решений.
Темы
Уровень
Сложность
По мотивам интервью в
551
Хабр Python — поиск аномалий в дневной выручке через rolling mean
PythonpandasСредняяMiddle
552
Хабр Python — list comprehension, map, filter и когда что выбирать
PythonPython базовыйЛёгкаяJunior
553
Хабр Python — изменяемый аргумент по умолчанию (mutable default)
PythonPython базовыйЛёгкаяJunior
554
Хабр Python — почему не нужно итерировать DataFrame через iterrows
Pythonpandas производительностьЛёгкаяJunior
555
Хабр Python — дедупликация заказов с правилом «оставить самый поздний»
PythonpandasСредняяJunior
556
LeetCode Pandas — выручка по месяцам и приросты MoM
Pythonpandas — даты и группировкаСредняяJunior
557
LeetCode Pandas — top-N продуктов по выручке в каждой категории
Pythonpandas — top-N per groupСредняяMiddle
558
LeetCode Pandas — forward fill по группам и проверка хвостов
Pythonpandas — пропускиСредняяJunior
559
LeetCode Pandas — pivot выручки по регионам и кварталам
Pythonpandas — pivotСредняяJunior
560
LeetCode Pandas — merge_asof: time-based join по последней цене
Pythonpandas — time-joinСложнаяSenior
561
InterviewQuery Pandas — RFM-сегментация через qcut
Pythonpandas — сегментацияСредняяMiddle
562
InterviewQuery Pandas — конверсия воронки и drop-off
Pythonpandas — воронкиСредняяMiddle
563
DataInterview Pandas — wide → long через melt и tidy data
Pythonpandas — reshapeЛёгкаяJunior
564
alexeygrigorev/data-science-interviews: FizzBuzz
PythonБазовый алгоритмЛёгкаяJunior
565
alexeygrigorev/data-science-interviews: палиндром
PythonСтрокиЛёгкаяJunior
566
alexeygrigorev/data-science-interviews: посчитать RMSE без библиотек
PythonМетрики качестваЛёгкаяJunior
567
alexeygrigorev/data-science-interviews: Jaccard similarity
PythonМетрики сходстваЛёгкаяJunior
568
alexeygrigorev/data-science-interviews: посчитать IDF по корпусу
PythonNLPСредняяMiddle
569
alexeygrigorev/data-science-interviews: PMI пар слов
PythonNLPСредняяMiddle
570
alexeygrigorev/data-science-interviews: удалить дубликаты из списка
PythonСтруктуры данныхЛёгкаяJunior
571
alexeygrigorev/data-science-interviews: подсчёт элементов
PythonСтруктуры данныхЛёгкаяJunior
572
alexeygrigorev/data-science-interviews: k-NN без библиотек
PythonML с нуляСредняяMiddle
573
alexeygrigorev/data-science-interviews: Two Sum за O(n)
PythonАлгоритмыЛёгкаяJunior
574
Сценарий: groupby с несколькими агрегациями и переименованием колонок
PythonPandas базовый workflowЛёгкаяJunior
575
Сценарий: чем pivot отличается от pivot_table и когда использовать каждую
PythonPandas базовый workflowЛёгкаяJunior
576
Сценарий: melt — перевод широкой таблицы в длинную
PythonPandas базовый workflowЛёгкаяJunior
577
Сценарий: типы merge в pandas и как они влияют на размер результата
PythonPandas базовый workflowСредняяJunior
578
Сценарий: resample временного ряда в pandas
PythonPandas базовый workflowСредняяMiddle
579
Сценарий: apply против векторизации — реальный бенчмарк
PythonВекторизация и performanceСредняяMiddle
580
Сценарий: pandas query и eval — когда дают выигрыш
PythonВекторизация и performanceСредняяMiddle
581
Сценарий: чанковая обработка CSV, который не помещается в память
PythonВекторизация и performanceСредняяMiddle
582
Сценарий: когда брать Dask, когда Polars, когда хватит pandas
PythonВекторизация и performanceСредняяMiddle
583
Сценарий: профайлинг медленного pandas-пайплайна
PythonВекторизация и performanceСредняяMiddle
584
Сценарий: дедупликация строк с правилом приоритета
PythonОчистка данныхЛёгкаяJunior
585
Сценарий: fuzzy-match для объединения справочников компаний
PythonОчистка данныхСредняяMiddle
586
Сценарий: стратегии обработки NaN — когда что
PythonОчистка данныхСредняяMiddle
587
Сценарий: типы данных в pandas — где промахи стоят дорого
PythonОчистка данныхСредняяMiddle
588
Сценарий: разношёрстные форматы дат в одной колонке
PythonОчистка данныхСредняяMiddle
589
Сценарий: сессионизация пользовательских событий с таймаутом 30 минут
PythonАнализ событийСредняяMiddle
590
Сценарий: воронка из event-стрима в pandas
PythonАнализ событийСредняяMiddle
591
Сценарий: time-since-last-event для каждой строки лога
PythonАнализ событийСредняяMiddle
592
Сценарий: gaps-and-islands в pandas — стрики и пропуски
PythonАнализ событийСложнаяMiddle
593
Сценарий: построение когортной retention-таблицы в pandas
PythonАнализ событийСредняяMiddle
594
Сценарий: numpy broadcasting — посчитать матрицу попарных расстояний без цикла
PythonNumpy и scipyСредняяMiddle
595
Сценарий: np.where, маска и np.select — что выбрать
PythonNumpy и scipyЛёгкаяJunior
596
Сценарий: scipy.stats для типичных тестов аналитика
PythonNumpy и scipyСредняяMiddle
597
Сценарий: pandas json_normalize для вложенного JSON
PythonJSON и веб-скрейпингСредняяMiddle
598
Сценарий: разбор глубоко вложенного JSON без потерь
PythonJSON и веб-скрейпингСредняяMiddle
599
Сценарий: скрейпинг таблицы с веб-страницы для еженедельного отчёта
PythonJSON и веб-скрейпингСредняяMiddle
600
Сценарий: чанки и Dask для агрегата по большим parquet
PythonOptimisation и big dataСредняяMiddle