Ситуация: После деплоя нового сервиса экспериментов сплит перестал быть 50/50: разобрать, как χ²-проверкой поймать SRM, отличить чистое AA-окно от перекоса и почему при SRM нельзя читать метрику.
Маркетплейс выкатил новый сервис назначения экспериментов вместе с новым ранжированием. Через несколько дней аналитик замечает, что распределение пользователей по бакетам эксперимента search_ranking_v3 перестало быть ровно 50/50. При этом дашборд показывает «победу» варианта: +2.1% GMV/сессия. Задача на собеседовании — понять, можно ли доверять этому результату, и что делать.
Эксперимент search_ranking_v3, назначение на уровне пользователя, целевой сплит 50/50Пред-релизное AA-окно: 50 123 / 49 877 (всего 100 000 юзеров) — сплит выглядит чистымПосле релиза: контроль 50 600 / вариант 49 400 (всего 100 000 юзеров)Разница 1 200 юзеров (50.6% vs 49.4%) — на глаз почти незаметнаГипотеза: JS-ошибка в варианте роняет часть сессий до записи назначения в трекингДашборд показывает вариант +2.1% GMV/сессия — но доверять этому нельзя до устранения SRM