Merge с suffixes и обработка дубликатов

Medium pandas pandas Yandex

Условие задачи

Дано два DataFrame: `users(id, name, country)` и `orders(user_id, amount, status)`. Сделайте LEFT join orders ← users (заказы основная таблица). Для одинаковых имён колонок используйте suffix _user. Затем посчитайте по каждой country сумму amount только для status="paid". Верните Series: country → total. Реализуй `revenue_by_country(orders, users)`.

Темы

pandas merge groupby

Подсказки

Что проверяет эта задача

Задача «Merge с suffixes и обработка дубликатов» учит обрабатывать табличные данные в pandas: фильтрация, группировка, объединение и метрики. Такие задачи дают на собеседованиях в Yandex и других IT-компаниях. Уровень средний — типичная боевая задача на уверенный Python.

Как подступиться к решению

Сначала разбери условие и формат входа-выхода, прикинь крайние случаи (пустой ввод, дубли, NaN). Затем выбери структуру данных и собери решение по шагам — начни с простого рабочего варианта, потом оптимизируй сложность. Код пишешь и запускаешь прямо в браузере: Python-тренажёр исполняет его через Pyodide (pandas, numpy, scipy) и проверяет результат автоматически.

В pandas один и тот же результат часто достаётся разными путями — через groupby, pivot_table, merge или векторные операции над колонками. Важно выбрать читаемый и быстрый: встроенные векторные методы почти всегда обгоняют циклы и построчный apply. На собеседовании ценят не только правильный ответ, но и то, как ты объясняешь выбор подхода, обрабатываешь пропуски (NaN) и оцениваешь, что будет на больших данных.

Разобраться в pandas системно — бесплатный курс «Pandas с нуля» и гайды по pandas.

Открыть задачу в тренажёре → ← Все Python-задачи