KMeans кластеризация

Medium scikit-learn ML Ozon

Условие задачи

Даны X -- данные о поведении 200 пользователей (2 признака). Кластеризуйте методом K-Means на 3 кластера (random_state=42, n_init=10 для воспроизводимости). Верните DataFrame с колонками feature_1, feature_2, cluster. Сохраните в `result`.

Темы

KMeans clustering unsupervised

Подсказки

Что проверяет эта задача

Задача «KMeans кластеризация» учит решать задачи на scikit-learn так, как это спрашивают на собеседовании аналитика данных. Такие задачи дают на собеседованиях в Ozon и других IT-компаниях. Уровень средний — типичная боевая задача на уверенный Python.

Как подступиться к решению

Сначала разбери условие и формат входа-выхода, прикинь крайние случаи (пустой ввод, дубли, NaN). Затем выбери структуру данных и собери решение по шагам — начни с простого рабочего варианта, потом оптимизируй сложность. Код пишешь и запускаешь прямо в браузере: Python-тренажёр исполняет его через Pyodide (pandas, numpy, scipy) и проверяет результат автоматически.

На собеседовании по Python для аналитика ценят чистый читаемый код, корректную обработку крайних случаев (пустой ввод, дубли, None) и умение вслух оценить сложность по времени и памяти. Часто просят не просто решить, а разобрать альтернативные подходы и показать, где наивное решение сломается на большом объёме данных.

Прокачать Python для аналитики — бесплатный курс «Pandas с нуля» и Python-тренажёр.

Открыть задачу в тренажёре → ← Все Python-задачи