pivot_table (long → wide) с aggfunc и fill_value. melt (wide → long) — id_vars/var_name/value_name. crosstab для подсчётов. stack/unstack через MultiIndex. Когда какой формат удобен (BI vs ML).
Реальные задачи аналитика: чистка грязных данных, pivot/melt, cohort/funnel в чистом pandas (без SQL), str/dt-аксессоры, парсинг логов и CRM. Что спрашивают на собесе под «вот данные — что сделаешь?».
Ключевые темы: data cleaning, pivot, melt, cohort, funnel, regex, str, dt, fuzzy match, parsing.
В Pro-подписке по этому конспекту получите: