Собесов

Каталог задач

87 задач из 1000. Страница 1 из 2. Авторские задачи для подготовки к собеседованиям аналитиков с разборами решений.

Темы
Уровень
Сложность
По мотивам интервью в
001
Python — длина самой длинной серии одинаковых символов
PythonСтроки и итерацияЛёгкаяJunior
002
Python/pandas — построение воронки из событий
PythonPandas и аналитикаСредняяMiddle
003
Python — слить пересекающиеся события одного пользователя
Pythonpandas / алгоритмыСредняяMiddle
004
Python — Union-Find для связанных записей по id/phone/mail
PythonGraph / Union-FindСложнаяMiddle
005
Retentioneering: момент времени, после которого человек спит с вероятностью 0.9
PythonКвантили и доверительные интервалыСредняяMiddle
006
Retentioneering: анализ эффективности товаров в Яндекс.Маркете (DRR/ROAS)
PythonМаркетинговая аналитикаСредняяMiddle
007
Aviasales Aviastats — ETL: разворот flights_info в строки
PythonETL и подготовка данныхСредняяMiddle
008
Aviasales Booking — Pandas: pivot по сопутствующим услугам
PythonPandas и аналитикаСредняяMiddle
009
Aviasales Junior — рефакторинг исследовательского скрипта для регулярного запуска
PythonЧистый код и регулярные джобыСредняяJunior
010
Python (senior) — Итератор vs генератор: в чём разница
PythonСтруктуры языкаСредняяSenior
011
Магнит Python — длина наибольшей последовательности одинаковых символов
PythonАлгоритмы и строкиЛёгкаяJunior
012
EasyBrain — кумулятивные показы рекламы по дням жизни когорты
PythonCohort / cumulative metricsСредняяMiddle
013
MediaScope — почасовая динамика телесмотрения с разнесением сессий по интервалам
PythonTime series / segmentationСредняяJunior
014
Amazon: сохранить LIST на диск — сложность и память
PythonСериализацияЛёгкаяJunior
015
Technesis: чистка и дедуп данных по гостиницам с двух платформ
PythonETL и data cleaningСредняяMiddle
016
ВК Junior: DPU и NPU по транзакциям из Excel
PythonExcel и pandasЛёгкаяJunior
017
ДКД МО ДЗМ: Excel/Python — анализ заболеваний COVID-19 по поликлиникам
PythonExcel и pandasЛёгкаяJunior
018
Градус: извлечение бренда и подбренда из наименования товара
PythonПарсинг текстаСредняяMiddle
019
Красный Яр / 585: прирост средней конверсии (LFL по магазинам СПб)
PythonExcel и pandasЛёгкаяJunior
020
Росмэн: прогноз продаж и оборачиваемости с помощью коэффициентов сезонности
PythonПрогнозированиеСредняяJunior
021
Совкомбанк Страхование: преобразование медицинского реестра
PythonETL и pandasЛёгкаяJunior
022
Совкомбанк Страхование: VBA / Python — извлечь город из адреса
PythonПарсинг текстаЛёгкаяJunior
023
Karpov ДЗ: Retention curve на pandas
PythonpandasСредняяJunior
024
Karpov ДЗ: Прогноз CLTV для подписочного сервиса
PythonCLTV / CohortСложнаяMiddle
025
Хабр Python — разница Series и DataFrame в pandas
Pythonpandas основыЛёгкаяJunior
026
Хабр Python — groupby с несколькими агрегатами и named aggregation
PythonpandasСредняяMiddle
027
Хабр Python — merge, join, concat в pandas: что выбрать
PythonpandasСредняяJunior
028
Хабр Python — стратегии заполнения пропусков (fillna, dropna, ffill)
PythonpandasСредняяJunior
029
Хабр Python — pivot_table для отчёта по категориям и месяцам
PythonpandasСредняяMiddle
030
Хабр Python — поиск аномалий в дневной выручке через rolling mean
PythonpandasСредняяMiddle
031
Хабр Python — list comprehension, map, filter и когда что выбирать
PythonPython базовыйЛёгкаяJunior
032
Хабр Python — изменяемый аргумент по умолчанию (mutable default)
PythonPython базовыйЛёгкаяJunior
033
Хабр Python — почему не нужно итерировать DataFrame через iterrows
Pythonpandas производительностьЛёгкаяJunior
034
Хабр Python — дедупликация заказов с правилом «оставить самый поздний»
PythonpandasСредняяJunior
035
LeetCode Pandas — выручка по месяцам и приросты MoM
Pythonpandas — даты и группировкаСредняяJunior
036
LeetCode Pandas — top-N продуктов по выручке в каждой категории
Pythonpandas — top-N per groupСредняяMiddle
037
LeetCode Pandas — forward fill по группам и проверка хвостов
Pythonpandas — пропускиСредняяJunior
038
LeetCode Pandas — pivot выручки по регионам и кварталам
Pythonpandas — pivotСредняяJunior
039
LeetCode Pandas — merge_asof: time-based join по последней цене
Pythonpandas — time-joinСложнаяSenior
040
InterviewQuery Pandas — RFM-сегментация через qcut
Pythonpandas — сегментацияСредняяMiddle
041
InterviewQuery Pandas — конверсия воронки и drop-off
Pythonpandas — воронкиСредняяMiddle
042
DataInterview Pandas — wide → long через melt и tidy data
Pythonpandas — reshapeЛёгкаяJunior
043
alexeygrigorev/data-science-interviews: FizzBuzz
PythonБазовый алгоритмЛёгкаяJunior
044
alexeygrigorev/data-science-interviews: палиндром
PythonСтрокиЛёгкаяJunior
045
alexeygrigorev/data-science-interviews: посчитать RMSE без библиотек
PythonМетрики качестваЛёгкаяJunior
046
alexeygrigorev/data-science-interviews: Jaccard similarity
PythonМетрики сходстваЛёгкаяJunior
047
alexeygrigorev/data-science-interviews: посчитать IDF по корпусу
PythonNLPСредняяMiddle
048
alexeygrigorev/data-science-interviews: PMI пар слов
PythonNLPСредняяMiddle
049
alexeygrigorev/data-science-interviews: удалить дубликаты из списка
PythonСтруктуры данныхЛёгкаяJunior
050
alexeygrigorev/data-science-interviews: подсчёт элементов
PythonСтруктуры данныхЛёгкаяJunior