Когортная таблица через groupby + period_number, retention rate как divide на размер cohort'ы. Воронка: max_step через groupby. Time-to-value (TTV) через date diff. CI на retention через beta-distribution.
Реальные задачи аналитика: чистка грязных данных, pivot/melt, cohort/funnel в чистом pandas (без SQL), str/dt-аксессоры, парсинг логов и CRM. Что спрашивают на собесе под «вот данные — что сделаешь?».
Ключевые темы: data cleaning, pivot, melt, cohort, funnel, regex, str, dt, fuzzy match, parsing.
В Pro-подписке по этому конспекту получите: