Дана logs(user_id, action, ts). В плане EXPLAIN ANALYZE видно, что оценка строк (estimated rows) — 50, а реально (actual rows) — 500000, из-за чего выбран Nested Loop вместо Hash Join и запрос тормозит. Первое разумное действие?
SQLmediummiddle
Проверяет владение SQL: выборки, агрегации, JOIN-ы и оконные функции.
EXPLAINстатистикапланировщик
Варианты ответа
Принудительно отключить Nested Loop через SET enable_nestloop = off в конфиге сервера, чтобы планировщик всегда выбирал Hash Join независимо от оценок
Переписать JOIN как коррелированный подзапрос с EXISTS — он не опирается на оценку кардинальности и выполняется построчно
Обновить статистику через ANALYZE (или увеличить статистику по колонке) — планировщик опирается на устаревшие оценки кардинальности
Добавить LIMIT в запрос, чтобы уменьшить фактическое число строк до оценочных 50 и подтолкнуть планировщик к Hash Join
Как разобрать этот вопрос на собеседовании
Начни с разбора схемы: какие таблицы и ключи участвуют, где могут быть NULL и дубли строк. Затем реши, что важнее — JOIN, агрегация с GROUP BY/HAVING, оконная функция или подзапрос. На собеседовании ценят не только правильный результат, но и умение проговорить план запроса и крайние случаи (пустые группы, деление на ноль, фан-аут при JOIN).
На собеседовании по такому вопросу важно не только назвать ответ, но и кратко объяснить, почему он верный.
Тема вопроса — «SQL». Чтобы подготовиться к похожим задачам, отрабатывай их на практике: sql-тренажёр помогает довести навык до автоматизма, а раздел вопросов — увидеть формулировки, которые реально встречаются на интервью аналитика данных.
Разбор ответа
Подробный разбор с объяснением «почему правильный ответ верный» и почему остальные неверны — после регистрации.
3000+ вопросов с разбором, quiz-режим с проверкой, AI-собес и подготовка к интервью аналитика.