Дано: DataFrame `data` с 5 признаками и target -- 200 строк. Разделите на X и y; проведите 5-fold кросс-валидацию модели Random Forest для регрессии (50 деревьев, random_state=42 для воспроизводимости) по метрике R² Сохраните dict {"cv_scores": list(round 4), "mean_r2": round(4), "std_r2": round(4), "is_stable": bool} в `result`. is_stable = True если std < 0.05.
cross_validation random_forest model_evaluation
Задача «Cross-validation: оценка устойчивости модели» учит решать задачи на scikit-learn так, как это спрашивают на собеседовании аналитика данных. Такие задачи дают на собеседованиях в Lamoda и других IT-компаниях. Уровень сложный — проверяет глубину и умение собрать решение из нескольких приёмов.
Сначала разбери условие и формат входа-выхода, прикинь крайние случаи (пустой ввод, дубли, NaN). Затем выбери структуру данных и собери решение по шагам — начни с простого рабочего варианта, потом оптимизируй сложность. Код пишешь и запускаешь прямо в браузере: Python-тренажёр исполняет его через Pyodide (pandas, numpy, scipy) и проверяет результат автоматически.
На собеседовании по Python для аналитика ценят чистый читаемый код, корректную обработку крайних случаев (пустой ввод, дубли, None) и умение вслух оценить сложность по времени и памяти. Часто просят не просто решить, а разобрать альтернативные подходы и показать, где наивное решение сломается на большом объёме данных.
Прокачать Python для аналитики — бесплатный курс «Pandas с нуля» и Python-тренажёр.
Открыть задачу в тренажёре → ← Все Python-задачи