Дано: DataFrame `events` с колонками user_id, event_date -- 40 строк логов активности пользователей за 3 месяца. Постройте когортную таблицу: строки -- месяц первой активности пользователя (когорта), столбцы -- сколько целых месяцев прошло с момента когорты до события (cohort_index), в ячейках -- количество уникальных user_id. Месяцы кодируйте как pandas-период "M". Сохраните pivot DataFrame в `result`.
cohort retention pivot_table period
Задача «Когортный анализ: retention по месяцам» учит обрабатывать табличные данные в pandas: фильтрация, группировка, объединение и метрики. Такие задачи дают на собеседованиях в VK и других IT-компаниях. Уровень сложный — проверяет глубину и умение собрать решение из нескольких приёмов.
Сначала разбери условие и формат входа-выхода, прикинь крайние случаи (пустой ввод, дубли, NaN). Затем выбери структуру данных и собери решение по шагам — начни с простого рабочего варианта, потом оптимизируй сложность. Код пишешь и запускаешь прямо в браузере: Python-тренажёр исполняет его через Pyodide (pandas, numpy, scipy) и проверяет результат автоматически.
В pandas один и тот же результат часто достаётся разными путями — через groupby, pivot_table, merge или векторные операции над колонками. Важно выбрать читаемый и быстрый: встроенные векторные методы почти всегда обгоняют циклы и построчный apply. На собеседовании ценят не только правильный ответ, но и то, как ты объясняешь выбор подхода, обрабатываешь пропуски (NaN) и оцениваешь, что будет на больших данных.
Разобраться в pandas системно — бесплатный курс «Pandas с нуля» и гайды по pandas.
Открыть задачу в тренажёре → ← Все Python-задачи