Есть users(id) и payments(user_id, amount), у активного юзера в среднем 4 платежа. Аналитик делает SELECT COUNT(*) FROM users u JOIN payments p ON p.user_id = u.id, чтобы посчитать число пользователей, и получает завышенное значение. В чём причина и как правильно?
SQLeasyjunior
Проверяет владение SQL: выборки, агрегации, JOIN-ы и оконные функции.
fan-outJOINдубли
Варианты ответа
COUNT(*) не считает NULL, поэтому часть строк теряется; нужно COUNT(1) вместо COUNT(*)
COUNT(*) в связке с JOIN всегда возвращает число строк payments; нужно COUNT(u.id)
JOIN размножает строки users по числу платежей (fan-out); нужно COUNT(DISTINCT u.id) или считать пользователей до джойна
JOIN по умолчанию берёт CROSS JOIN, если не указан INNER; нужно явно написать INNER JOIN
Как разобрать этот вопрос на собеседовании
Начни с разбора схемы: какие таблицы и ключи участвуют, где могут быть NULL и дубли строк. Затем реши, что важнее — JOIN, агрегация с GROUP BY/HAVING, оконная функция или подзапрос. На собеседовании ценят не только правильный результат, но и умение проговорить план запроса и крайние случаи (пустые группы, деление на ноль, фан-аут при JOIN).
Это базовый вопрос — на собеседовании его задают как разминку и фильтр, поэтому важно ответить уверенно и без заминок.
Тема вопроса — «SQL». Чтобы подготовиться к похожим задачам, отрабатывай их на практике: sql-тренажёр помогает довести навык до автоматизма, а раздел вопросов — увидеть формулировки, которые реально встречаются на интервью аналитика данных.
Разбор ответа
Подробный разбор с объяснением «почему правильный ответ верный» и почему остальные неверны — после регистрации.
3000+ вопросов с разбором, quiz-режим с проверкой, AI-собес и подготовка к интервью аналитика.